Trong cộng đồng AI mã nguồn mở, ai cũng nhận thấy khoảng cách giữa họ và các “ông lớn” công nghệ không chỉ đơn thuần là sức mạnh tính toán. Ai2 đang nỗ lực thu hẹp khoảng cách này, bằng cách cung cấp cơ sở dữ liệu và mô hình mã nguồn mở và gần đây nhất là Tülu 3 – một quy trình hậu huấn luyện mở, dễ điều chỉnh, giúp chuyển đổi các mô hình ngôn ngữ lớn (LLM) từ dạng “thô” sang dạng ứng dụng thực tiễn.
Khác với quan niệm phổ biến, các mô hình ngôn ngữ “nền tảng” sau khi được huấn luyện xong chưa sẵn sàng để triển khai. Tiền huấn luyện là bước cần thiết, nhưng chưa đủ. Thậm chí, nhiều chuyên gia tin rằng tiền huấn luyện có thể sớm không còn là yếu tố quan trọng nhất.
Giá trị thực sự được tạo ra ở giai đoạn hậu huấn luyện. Đây là giai đoạn “nhào nặn” mô hình từ một mạng lưới khổng lồ, chứa đựng lượng kiến thức đồ sộ, nhưng chưa được tinh chỉnh, có thể tạo ra cả nội dung tiêu cực lẫn tích cực.
Các công ty lớn thường giữ bí mật về quy trình hậu huấn luyện của họ. Lý do là, mặc dù ai cũng có thể thu thập dữ liệu web và xây dựng mô hình bằng các phương pháp tiên tiến, nhưng việc tinh chỉnh mô hình để phục vụ cho các mục đích cụ thể, ví dụ như hỗ trợ trị liệu tâm lý hay phân tích nghiên cứu, lại là một thách thức hoàn toàn khác biệt.
Ai2 (trước đây là Viện AI Allen) đã lên tiếng về sự thiếu minh bạch trong các dự án AI “mở” như Llama của Meta. Mặc dù mô hình này miễn phí sử dụng và điều chỉnh, nhưng nguồn dữ liệu, quy trình tạo ra mô hình thô và phương pháp huấn luyện để sử dụng chung vẫn được giữ kín. Điều này không hẳn là xấu, nhưng cũng không thực sự “mở”.
Ngược lại, Ai2 cam kết tối đa hóa tính minh bạch, từ việc công khai dữ liệu, quy trình thu thập, quản lý, làm sạch dữ liệu, đến phương pháp huấn luyện được sử dụng để tạo ra các LLM như OLMo.
Tuy nhiên, thực tế là rất ít nhà phát triển có đủ năng lực để tự vận hành LLM, và càng ít người có thể thực hiện hậu huấn luyện như Meta, OpenAI hay Anthropic. Nguyên nhân một phần là do thiếu kiến thức chuyên môn, một phần do quy trình này phức tạp và tốn thời gian.
Với mong muốn dân chủ hóa khía cạnh này của hệ sinh thái AI, Ai2 đã phát triển Tülu 3. Đây là phiên bản cải tiến vượt bậc so với quy trình hậu huấn luyện trước đó (Tülu 2). Kết quả thử nghiệm cho thấy Tülu 3 đạt hiệu suất tương đương với các mô hình “mở” tiên tiến nhất hiện nay. Để đạt được điều này, Ai2 đã dành nhiều tháng nghiên cứu, thử nghiệm, phân tích các thông tin được hé lộ từ các công ty lớn, và thực hiện nhiều lần huấn luyện lặp đi lặp lại.
Tülu 3 bao gồm toàn bộ quy trình, từ việc lựa chọn trọng tâm cho mô hình (ví dụ: giảm khả năng đa ngôn ngữ, tăng cường toán học và lập trình), đến việc áp dụng các kỹ thuật quản lý dữ liệu, học tăng cường, tinh chỉnh, điều chỉnh siêu tham số và quy trình huấn luyện. Mục tiêu là tạo ra một mô hình hiệu quả, tập trung vào các kỹ năng cần thiết.
Ý nghĩa quan trọng của Tülu 3 là giúp cộng đồng AI mã nguồn mở giảm sự phụ thuộc vào các công ty tư nhân. Trước đây, việc xây dựng LLM tùy chỉnh thường phải sử dụng tài nguyên của các công ty lớn hoặc thuê dịch vụ từ bên thứ ba, dẫn đến chi phí cao và rủi ro bảo mật.
Ví dụ, với các công ty nghiên cứu và dịch vụ y tế, việc sử dụng API của OpenAI hoặc hợp tác với Scale để tùy chỉnh mô hình nội bộ đều tiềm ẩn rủi ro liên quan đến dữ liệu người dùng nhạy cảm. Tülu 3, cùng với các mô hình mã nguồn mở như OLMo, mang đến giải pháp thay thế hiệu quả, cho phép triển khai và kiểm soát toàn bộ quy trình huấn luyện ngay tại chỗ.
Bản thân Ai2 cũng đang sử dụng Tülu 3, đây là minh chứng rõ ràng nhất cho hiệu quả của công cụ này. Mặc dù các kết quả thử nghiệm hiện tại sử dụng Llama làm mô hình nền tảng, Ai2 dự kiến sẽ sớm ra mắt mô hình dựa trên OLMo và được huấn luyện bởi Tülu 3, hứa hẹn mang đến những cải tiến vượt trội hơn nữa, đồng thời hoàn toàn là mã nguồn mở.
Tin tài trợ
-
Tài trợQuảng cáo
Noise ra mắt Power Series với sạc GaN hiện đại
Noise vừa chính thức bước vào thị trường phụ kiện cao cấp với dòng sản phẩm Power Series. Các sản phẩm mới trong bộ sưu tập này bao gồm bộ sạc GaN (Gallium Nitride) và cáp từ tính Type-C to C, được thiết kế dành riêng cho người dùng yêu cầu cao về hiệu suất, […] -
Tài trợQuảng cáo
Khám phá HiBy R1: Máy nghe nhạc bỏ túi với âm thanh cao cấp
Mix Wave vừa giới thiệu mẫu máy nghe nhạc kỹ thuật số HiBy R1, một sản phẩm hướng đến những người yêu thích âm nhạc chất lượng cao. Với thiết kế nhỏ gọn và nhiều màu sắc trẻ trung, HiBy R1 không chỉ là thiết bị phát nhạc mà còn là một phụ kiện phong […] -
Tài trợQuảng cáo
Loa Xiaomi Mini: Đổi mới với phiên bản đỏ rượu vang đầy cuốn hút
Xiaomi vừa giới thiệu phiên bản mới cho dòng loa Bluetooth Speaker Mini với sự bổ sung màu sắc đặc biệt đỏ rượu vang (burgundy red). Đây là dòng sản phẩm nổi bật nhờ thiết kế nhỏ gọn, khả năng chống chịu thời tiết khắc nghiệt, thời lượng pin dài và âm thanh ổn định. […] -
Tài trợQuảng cáo
Petbrick 65: Khi bàn phím cơ biến thành thú cưng của bạn
Angry Miao, hãng sản xuất bàn phím nổi tiếng với thiết kế sáng tạo, tiếp tục gây chú ý khi ra mắt sản phẩm mới mang tên Petbrick 65. Đây là bàn phím cơ có vỏ ngoài lông xù, mang đến cảm giác có thể vuốt ve như một chú mèo. Thiết kế lấy cảm […]
Bài viết liên quan
NUC 14 Pro AI của ASUS: Sức mạnh AI trong một chiếc mini PC
OpenAI “khuấy đảo” giới công nghệ với mô hình o3 mới
Huấn luyện robot nhanh gấp 430,000 lần với Genesis
Google Gemini Deep Research: Tìm kiếm thông tin dễ dàng và nhanh chóng hơn bao giờ hết
Trường học không giáo viên: Khi AI thay đổi cách chúng ta học tập
Android 16 cho phép người dùng kiểm soát nội dung do AI tạo ra
Gmail tăng cường bảo mật với AI để chặn thư rác hiệu quả hơn
Apple và Nvidia ‘bắt tay’ tạo ra bước đột phá trong AI
Google Gemini: Đánh giá AI có chính xác khi thiếu chuyên môn?
Khi trí tuệ nhân tạo học cách “đóng kịch” để sinh tồn
ChatGPT giờ đây có thể gọi điện và nhắn tin qua WhatsApp
Mondelez sử dụng AI để phát triển snack mới nhanh hơn
AI tham gia vào quá trình sản xuất bánh Oreo, hứa hẹn nhiều điều thú vị
Người dùng Google được trải nghiệm Gemini 2.0 Experimental Advanced
Insta360 Connect: Tối ưu họp trực tuyến với camera 4K và AI
o1 của OpenAI: Mở ra kỷ nguyên mới cho phát triển ứng dụng AI?
Kính thông minh Meta “lột xác” với AI và Shazam, nhận diện bài hát tức thì
Romi Lacatan: Robot AI hỗ trợ giao tiếp, giúp đỡ người cô đơn
Whisk: Công cụ AI mới của Google sử dụng hình ảnh làm gợi ý, thay vì văn bản
ĐĂNG KÝ NHẬN TIN
NGAY HÔM NAY
Đăng ký để nhận thông tin sớm nhất về những câu chuyện nóng hổi hiện nay trên thị trường, công nghệ được cung cấp hàng ngày.
Bằng cách nhấp vào “Đăng ký”, bạn chấp nhận Điều khoản dịch vụ và Chính sách quyền riêng tư của chúng tôi. Bạn có thể chọn không tham gia bất cứ lúc nào.
5
s
Nhận xét (0)