Startup AI Mistral vừa ra mắt API mới dành cho việc kiểm duyệt nội dung. API này, cũng chính là API hỗ trợ tính năng kiểm duyệt trên nền tảng chatbot Le Chat của Mistral, có thể được điều chỉnh cho phù hợp với các ứng dụng và tiêu chuẩn an toàn cụ thể. API này được hỗ trợ bởi một mô hình tinh chỉnh (Ministral 8B) được huấn luyện để phân loại văn bản bằng nhiều ngôn ngữ, bao gồm tiếng Anh, tiếng Pháp và tiếng Đức, thành một trong chín loại: tình dục, thù địch và phân biệt đối xử, bạo lực và đe dọa, nội dung nguy hiểm và phạm pháp, tự gây hại, sức khỏe, tài chính, pháp luật và thông tin nhận dạng cá nhân.
API kiểm duyệt có thể được áp dụng cho cả văn bản thô hoặc văn bản hội thoại, Mistral cho biết: “Trong vài tháng qua, chúng tôi đã chứng kiến sự quan tâm ngày càng tăng trong ngành và cộng đồng nghiên cứu đối với các hệ thống kiểm duyệt mới dựa trên AI, có thể giúp việc kiểm duyệt trở nên có khả năng mở rộng và mạnh mẽ hơn trên các ứng dụng”. Bộ phân loại kiểm duyệt nội dung của chúng tôi tận dụng các danh mục chính sách phù hợp nhất để tạo ra các rào cản hiệu quả và giới thiệu một cách tiếp cận thực dụng đối với an toàn mô hình bằng cách giải quyết các tác hại do mô hình tạo ra như lời khuyên không đủ tiêu chuẩn và thông tin nhận dạng cá nhân.
Các hệ thống kiểm duyệt do AI hỗ trợ rất hữu ích về mặt lý thuyết. Nhưng chúng cũng dễ bị ảnh hưởng bởi những thành kiến và lỗ hổng kỹ thuật tương tự như các hệ thống AI khác.
Ví dụ: một số mô hình được huấn luyện để phát hiện độc tính lại coi các cụm từ trong tiếng Anh bản ngữ của người Mỹ gốc Phi (AAVE), ngữ pháp không chính thức được sử dụng bởi một số người Mỹ da đen, là “độc hại” một cách không tương xứng. Các nghiên cứu đã phát hiện ra rằng các bài đăng trên mạng xã hội về người khuyết tật cũng thường bị gắn cờ là tiêu cực hoặc độc hại hơn bởi các mô hình phát hiện độc tính và tình cảm công khai thường được sử dụng.
Mistral tuyên bố rằng mô hình kiểm duyệt của họ có độ chính xác cao – nhưng cũng thừa nhận rằng nó vẫn đang được phát triển. Đáng chú ý, công ty không so sánh hiệu suất của API của mình với các API kiểm duyệt phổ biến khác, như Perspective API của Jigsaw và API kiểm duyệt của OpenAI.
“Chúng tôi đang hợp tác với khách hàng của mình để xây dựng và chia sẻ các công cụ kiểm duyệt có khả năng mở rộng, gọn nhẹ và có thể tùy chỉnh”, công ty cho biết và sẽ tiếp tục hợp tác với cộng đồng nghiên cứu để đóng góp những tiến bộ về an toàn cho lĩnh vực rộng lớn hơn.”
Mistral cũng đã công bố API hàng loạt vào hôm nay. Công ty cho biết họ có thể giảm 25% chi phí của các mô hình được phục vụ thông qua API của mình bằng cách xử lý các yêu cầu khối lượng lớn một cách không đồng bộ. Anthropic, OpenAI, Google và những công ty khác cũng cung cấp các tùy chọn xử lý hàng loạt cho API AI của họ.
Tin tài trợ
-
Tài trợKhám phá
AE-1600 lên kệ: Casio ra mắt đồng hồ bền bỉ, đa năng
Dòng đồng hồ Casio AE-1600, được công bố vào cuối năm 2024, hiện đã cho phép đặt hàng trước trên Amazon. Ngày phát hành chính thức là 1/2/2025. Bộ sưu tập bao gồm ba mẫu với các màu đen, be và xám, mỗi chiếc có giá 77,94 USD (khoảng 1,8 triệu VNĐ). Pin 10 năm, […] -
Tài trợMobile
Garmin Approach S44: Đồng hồ thông minh cho golfer, pin “trâu” 10 ngày
Garmin vừa ra mắt đồng hồ thông minh Approach S44 GPS dành cho golfer trên toàn cầu. Đồng hồ có màn hình AMOLED màu 1.2 inch, vòng bezel bằng nhôm màu bạc và dây đeo silicon màu đen hoặc xám xanh (Twilight). Tính năng “chuẩn golfer” Approach S44 được trang bị nhiều tính năng hỗ […] -
Tài trợData
Lenovo ra mắt ổ SSD “hình lựu đạn”, “cấm” mang lên máy bay?
Lenovo vừa giới thiệu một ổ SSD gắn ngoài có thiết kế “độc nhất vô nhị”: hình lựu đạn. Sản phẩm này được lấy cảm hứng từ bộ phim bom tấn “Chiến dịch Rồng” (hay còn gọi là “Chiến dịch Leviathan” hoặc “Chiến dịch Hadal”) của Trung Quốc. Tuy nhiên, với hình dạng “nhạy cảm” […] -
Tài trợMobile
Máy ảnh lấy liền 2 trong 1: Instax Wide Evo “gây sốt” với thiết kế “retro”
Fujifilm vừa bổ sung vào gia đình Instax một chiếc máy ảnh lấy liền “lai” mới, sử dụng phim Instax Wide. Instax Wide Evo nổi bật với ống kính siêu rộng 16mm “đầu tiên trên thế giới” và khả năng điều chỉnh thủ công với hơn 100 kiểu phim và hiệu ứng. “Lai” ở đây […]
Bài viết liên quan
OpenAI “ém hàng” Operator, công cụ AI với khả năng đáng kinh ngạc?
ChatGPT “chống lại” Google: Lãnh đạo sản phẩm làm chứng chống độc quyền
Cải tiến trải nghiệm AI: Google cấp phép tin tức AP cho Gemini
MiniMax vs. OpenAI: Cuộc chiến mới trong lĩnh vực AI?
GenEx: Công nghệ biến ảnh tĩnh thành thế giới ảo sống động
Máy tính lượng tử lớn nhất: AI giúp tối ưu hóa sắp xếp nguyên tử
Trợ lý ảo Mercedes-Benz được nâng cấp với AI đàm thoại của Google
Adobe “cách mạng hóa” chỉnh sửa ảnh với công cụ AI mới
Nvidia ủng hộ Trump, chỉ trích chính sách AI của Biden
Elon Musk: Dữ liệu tổng hợp là chìa khóa cho tương lai AI
OpenAI đưa ra “bản thiết kế” mới cho quy định AI
Ballie – Robot AI “vạn năng” của Samsung sắp ra mắt trong năm nay
Phụ đề AI ngoại tuyến: Cách mạng hóa trải nghiệm xem phim
Grok AI: Điều gì khiến trợ lý AI này trở nên đặc biệt?
Nvidia Digits: Siêu máy tính chỉ 3.000 USD, nhỏ gọn bất ngờ
Kính thông minh Halliday với màn hình và hệ thống điều khiển độc đáo
Gương thông minh “thần kỳ” đánh giá sức khỏe người dùng
Sansui sẽ “khuấy đảo” thị trường với TV OLED và màn hình chơi game AI mới?
Rò rỉ Galaxy S25: AI camera, AI trợ lý ảo, AI chỉnh sửa ảnh?
ĐĂNG KÝ NHẬN TIN
NGAY HÔM NAY
Đăng ký để nhận thông tin sớm nhất về những câu chuyện nóng hổi hiện nay trên thị trường, công nghệ được cung cấp hàng ngày.
Bằng cách nhấp vào “Đăng ký”, bạn chấp nhận Điều khoản dịch vụ và Chính sách quyền riêng tư của chúng tôi. Bạn có thể chọn không tham gia bất cứ lúc nào.
5
s
Nhận xét (0)