Mistral hôm 6-10 công bố một mô hình AI mới mà công ty Pháp cho biết nằm trong nhóm những mô hình mở tốt nhất thế giới, trong bối cảnh các công ty phương Tây chạy đua thu hẹp khoảng cách năng lực với các nhà phát triển Trung Quốc trong lĩnh vực mô hình mở.
Mistral Large 4 (ML4), còn được gọi là “le Chonk”, có 1.000 tỷ tham số, đặc biệt hiệu quả trong các tác vụ liên quan đến an ninh mạng, lập trình, sản xuất công nghiệp, tài chính và xử lý đa phương thức, theo Mistral.
Từ lâu được xem là câu trả lời duy nhất của châu Âu trước OpenAI và Anthropic, Mistral đã huy động 3 tỷ euro (3,4 tỷ đô la Mỹ) trong vòng gọi vốn Series D hồi tháng 9, với mức định giá 21 tỷ euro. Vòng gọi vốn này củng cố vị thế của Mistral trong nhóm các startup AI được rót vốn nhiều nhất và có giá trị cao nhất châu Âu.
Quyền tiếp cận các mô hình AI mở, trong đó những mô hình có năng lực cao nhất hiện chủ yếu đến từ Trung Quốc, đang trở thành một điểm nóng trong cuộc đua giành ưu thế công nghệ ngày càng gay gắt giữa Mỹ và Trung Quốc.
Các mô hình AI mở cho phép người dùng chỉnh sửa và tự triển khai trên hệ thống của mình, trái với các mô hình đóng hàng đầu do OpenAI và Anthropic phát triển. Các mô hình mở của Trung Quốc ngày càng được sử dụng rộng rãi trên thế giới.
Mistral Large 4 được phát hành dưới dạng bản xem trước cho các nhà phát triển, lãnh đạo an ninh mạng và cơ quan nhà nước trước khi được cung cấp rộng rãi hơn vào cuối tháng này, công ty cho biết.
Sự trỗi dậy của mô hình mở
ML4 được huấn luyện trong hai tháng trên 4.000 bộ xử lý đồ họa Nvidia Grace Blackwell, được triển khai tại các trung tâm dữ liệu của Mistral ở châu Âu.
Mistral cho biết khi công bố đầy đủ các tham số cốt lõi, ML4 sẽ nằm trong nhóm các mô hình có trọng số mở hàng đầu thế giới xét trên tổng thể kết quả các bài kiểm chuẩn. Công ty cũng cho rằng ML4 là mô hình có trọng số mở mạnh nhất được phát triển bên ngoài Trung Quốc, với khoảng cách “đáng kể” so với các đối thủ. Tuy nhiên, mô hình mới vẫn kém các mô hình tiên tiến nhất trong một số lĩnh vực, chẳng hạn lập trình.
“Khả năng của mô hình sẽ tiếp tục được cải thiện khi chúng tôi mở rộng năng lực huấn luyện sau vòng gọi vốn Series D,” Guillaume Lample, đồng sáng lập kiêm giám đốc khoa học của Mistral, cho biết.
Ông nói thêm rằng năng lực phòng thủ mạng của ML4 sẽ giúp doanh nghiệp và chính phủ tự bảo vệ trước các tác nhân đe dọa tìm cách vượt qua các cơ chế bảo vệ của những mô hình đóng để thực hiện các cuộc tấn công mạng.
Các mô hình mở thu hút sự chú ý mạnh hồi đầu năm nay sau khi startup Hugging Face được cho là đã sử dụng GLM 5.2 của công ty Trung Quốc Z.ai để ứng phó với một vụ xâm nhập do các tác nhân AI của OpenAI hoạt động trái phép gây ra.
Ban đầu, Hugging Face sử dụng các mô hình đóng hàng đầu của Mỹ để tự vệ, nhưng bị các cơ chế bảo vệ của những mô hình này chặn lại do nhầm hoạt động phòng thủ của công ty với một cuộc tấn công.
Startup Mỹ Reflection AI, được Nvidia hậu thuẫn, hôm 5-10 ra mắt mô hình mở đầu tiên và tuyên bố mô hình này có năng lực tương đương GLM 5.2. GLM 5.2 sau đó đã bị GLM 5.3 vượt qua vào tháng 8.

Mèo Le Chat, trợ lý AI của Mistral, trong hình minh họa với tháp Eiffel tại Paris, Pháp. Ảnh: Credit: VentureBeat

\Ảnh minh họa Mistral AI. Ảnh: Getty Images

