Mô hình AI
30 articles

Moonshot AI tạm dừng đăng ký Kimi K3 mới do nhu cầu vượt quá khả năng tính toán
Vài ngày sau khi ra mắt Kimi K3, Moonshot AI của Trung Quốc đã tạm dừng đăng ký trả phí mới vì nhu cầu về mô hình trọng lượng mở đã lấn át cơ sở hạ tầng điện toán của nó.

Alibaba ra mắt Qwen3.8-Max với 2,4 nghìn tỷ tham số, tuyên bố rằng nó chỉ sau Truyện ngụ ngôn của loài người 5
Nhóm Qwen của Alibaba đã tiết lộ bản xem trước Qwen3.8-Max với 2,4 nghìn tỷ tham số, mô hình đa phương thức nghìn tỷ tham số đầu tiên của họ, cho biết nó chỉ kém Fable 5 của Anthropic khi nó di chuyển để làm giảm đà của Kimi K3.
Hiệp hội Đức phát hành Soofi S, mô hình 30B mở đứng đầu các tiêu chuẩn tiếng Anh và tiếng Đức
Một tập đoàn của Đức đã phát hành Soofi S 30B-A3B, một mô hình MoE lai được đào tạo trên đám mây Munich của Deutsche Telekom, đứng đầu các mô hình mở hoàn toàn theo tiêu chuẩn của Anh và Đức.

Kimi K3 của Moonshot AI: Mô hình mở 2,8 nghìn tỷ tham số thách thức Claude và GPT
Moonshot AI của Trung Quốc đã phát hành Kimi K3, một mô hình mở có 2,8 nghìn tỷ tham số, chỉ xếp sau Claude Fable 5 và GPT-5.6 Sol, đồng thời đứng đầu Frontend Code Arena.
NVIDIA phát hành Nemotron 3 Embed, Bộ sưu tập nhúng mở với mẫu 8B đứng đầu bảng xếp hạng RTEB
Bộ sưu tập Nemotron 3 Embed mở của NVIDIA nhắm mục tiêu truy xuất RAG và tác nhân ở quy mô sản xuất, với điểm kiểm tra 8B xếp hạng số 1 trên điểm chuẩn RTEB.
Moonshot AI tiết lộ Kimi K3, Mô hình trọng lượng mở 2,8 nghìn tỷ tham số thách thức các đối thủ hàng đầu của Hoa Kỳ
Moonshot AI của Trung Quốc đã công bố Kimi K3, mẫu máy có trọng lượng mở lớn nhất thế giới với 2,8 nghìn tỷ thông số, gần như ngang bằng với GPT-5.6 và Claude Fable 5 với chi phí chỉ bằng một phần nhỏ.

Cổ phiếu của Alphabet giảm 4% khi Google trì hoãn Gemini 3.5 Pro một lần nữa vì thiếu sót về mã hóa
Mẫu Gemini 3.5 Pro hàng đầu của Google chậm tiến độ nhiều tháng do hiệu suất mã hóa không đạt được mục tiêu nội bộ, khiến cổ phiếu Alphabet giảm 4% khi các đối thủ vượt lên dẫn trước.
Máy tư duy của Mira Murati ra mắt Inkling, Mô hình AI trọng lượng mở 975 tỷ tham số
Phòng thí nghiệm máy tư duy, được thành lập bởi cựu CTO OpenAI Mira Murati, đã phát hành mô hình đầu tiên của mình: mô hình trọng lượng mở 975 tỷ tham số được thiết kế để tùy chỉnh so với sự thống trị của điểm chuẩn thô.
GPT-5.6 Sol của OpenAI xóa tệp và cơ sở dữ liệu người dùng, làm dấy lên lo ngại về an toàn
Các nhà phát triển báo cáo GPT-5.6 Sol xóa các tệp, cơ sở dữ liệu và toàn bộ thư mục mà không được phép. Thẻ hệ thống riêng của OpenAI đã cảnh báo rủi ro trước khi ra mắt.
Meta ra mắt Muse Spark 1.1 với mức giá API linh hoạt, khơi dậy cuộc chiến giá mã hóa AI
Mô hình AI trả phí đầu tiên của Meta, Muse Spark 1.1, ra mắt ở mức 1,25 USD trên một triệu mã thông báo đầu vào với cửa sổ ngữ cảnh 1M, hạ giá OpenAI, Anthropic và xAI trong thị trường mã hóa.
OpenAI ra mắt GPT-Live: Các mẫu giọng nói song công hoàn toàn nghe và nói cùng một lúc
Các mẫu giọng nói GPT-Live mới của OpenAI cho phép ChatGPT nghe và nói đồng thời bằng kiến trúc song công hoàn toàn. GPT-Live-1 hiện đã có sẵn cho người dùng trả phí.
Refiant ra mắt Protea, Mô hình AI cửa sổ ngữ cảnh 10 triệu mã thông báo, không cần danh sách chờ
Refiant, người sáng lập ở Nam Phi, đã ra mắt Protea, một bộ mô hình AI ngữ cảnh dài với cửa sổ ngữ cảnh 10 triệu mã thông báo có sẵn ngay lập tức mà không cần danh sách chờ, nhắm mục tiêu vào cơ sở mã doanh nghiệp và kho lưu trữ theo quy định.
Mistral AI ra mắt Robostral Navigate, Mô hình Robotics đầu tiên dành cho Điều hướng Robot một camera
Robostral Navigate của Mistral AI là mô hình 8B cho phép robot điều hướng tự động trong các môi trường phức tạp chỉ bằng một camera RGB duy nhất, đạt 76,6% trên điểm chuẩn R2R-CE.
OpenAI được bật đèn xanh để phát hành GPT-5.6 cho mọi người vào ngày 9 tháng 7
Bộ Thương mại Hoa Kỳ đã cho phép OpenAI phát hành công khai GPT-5.6 Sol, Terra và Luna vào ngày 9 tháng 7, chấm dứt nhiều tuần giới hạn do chính phủ yêu cầu.
SpaceXAI ra mắt Grok 4.5 trong nỗ lực chung với Cursor, thách thức Anthropic và OpenAI
SpaceXAI của Elon Musk đã phát hành Grok 4.5, một mô hình 1,5 nghìn tỷ tham số được đào tạo bằng dữ liệu Con trỏ, khẳng định hiệu suất cấp Opus với chi phí thấp hơn. Sự ra mắt này đánh dấu lần phát hành lớn đầu tiên của xAI dưới thương hiệu SpaceXAI mới.

Meta ra mắt Muse Image, Trình tạo hình ảnh AI nội bộ đầu tiên, bên trong Instagram và WhatsApp
Meta ra mắt Muse Image và Muse Video vào ngày 7 tháng 7 năm 2026, công cụ tạo hình ảnh AI nội bộ đầu tiên của họ, được tích hợp trong Instagram, WhatsApp và chatbot Meta AI.

Bồ Đào Nha ra mắt Amália, Mô hình AI nguồn mở đầu tiên, nhằm thúc đẩy chủ quyền AI của châu Âu
Bồ Đào Nha đã phát hành Amália, mô hình AI quốc gia nguồn mở đầu tiên, được xây dựng cho người Bồ Đào Nha ở châu Âu dưới dạng cơ sở hạ tầng kỹ thuật số công cộng. Đây là những gì nó làm và ai đã xây dựng nó.

Mô hình AI 'Dưa hấu' của Meta phù hợp với GPT-5.5 về điểm chuẩn khi Zuckerberg đánh dấu sự chậm trễ của đại lý
Giám đốc Meta AI Alexandr Wang cho biết mô hình tiếp theo, Dưa hấu, đã bắt kịp GPT-5.5 của OpenAI bằng cách sử dụng khả năng tính toán cao hơn gấp 10 lần, ngay cả khi Zuckerberg thừa nhận các tác nhân AI đang chậm tiến độ.

Google cung cấp Nano Banana 2 Lite và Gemini Omni Flash để tạo phương tiện truyền thông nhanh hơn, rẻ hơn
Google đã phát hành Nano Banana 2 Lite, mẫu hình ảnh nhanh nhất với giá 0,034 USD trên 1.000 hình ảnh, cùng với Gemini Omni Flash để tạo video và chỉnh sửa hội thoại vào ngày 30 tháng 6 năm 2026.

Anthropic ra mắt Claude Sonnet 5, mẫu máy tầm trung có tác dụng tốt nhất từ trước đến nay
Anthropic phát hành Claude Sonnet 5 vào ngày 30 tháng 6 năm 2026, một mô hình tầm trung có hiệu suất tác nhân cạnh tranh với Opus 4.8 với chi phí thấp hơn nhiều, với mức giá giới thiệu là 2 USD trên một triệu mã thông báo đầu vào.

Meituan mã nguồn mở LongCat-2.0, mô hình mã hóa 1,6 nghìn tỷ thông số được đào tạo hoàn toàn trên chip Trung Quốc
Meituan của Trung Quốc đã phát hành LongCat-2.0, mô hình mã hóa Hỗn hợp các chuyên gia gồm 1,6 nghìn tỷ thông số được đào tạo trên 50.000 chip nội địa mà không cần phần cứng Nvidia.
Chế độ nhanh Claude Opus 4.8 xuất hiện trong GitHub Copilot khi Anthropic đẩy sâu hơn vào mã hóa
GitHub Copilot hiện cung cấp bản xem trước chế độ nhanh Claude Opus 4.8, giúp các nhà phát triển tăng tốc độ gấp 2,5 lần với chi phí thấp hơn so với chế độ nhanh trước đây.

Châu Âu chọn Domyn của Milan để xây dựng mô hình AI mở 400 tỷ tham số
EU đã chọn tập đoàn EUROPA do công ty khởi nghiệp Domyn của Ý đứng đầu để xây dựng mô hình AI biên giới có trọng lượng mở, khoảng 400 tỷ tham số, bao gồm tất cả 24 ngôn ngữ chính thức của EU.
OpenAI ra mắt GPT-5.6 Sol, Terra và Luna ở dạng bản xem trước giới hạn với các rào chắn an toàn mới
OpenAI đã công bố dòng GPT-5.6 do Flagship Sol dẫn đầu, với các cấp độ Terra và Luna, lý luận đa tác nhân mới và ngăn xếp an toàn mạnh mẽ nhất của nó trong một bản xem trước so le.

Sakana AI ra mắt Fugu, một hệ thống đa tác nhân cạnh tranh với các mô hình biên giới bằng cách điều phối các đối thủ
Công ty khởi nghiệp Sakana AI ở Tokyo đã tiết lộ Fugu, một công cụ điều phối API đơn có khả năng tự động định tuyến các nhiệm vụ trên một nhóm LLM biên giới có thể hoán đổi để phù hợp với Fable 5 của Anthropic.
Google bổ sung tính năng sử dụng máy tính tích hợp cho Gemini 3.5 Flash cho các tác nhân AI đa nền tảng
Google DeepMind đã khiến máy tính sử dụng công cụ tích hợp sẵn trong Gemini 3.5 Flash, với các biện pháp bảo vệ doanh nghiệp và đào tạo đối nghịch để hạn chế rủi ro bị tiêm nhiễm kịp thời.
Microsoft công bố bảy mô hình MAI nội bộ không cần chưng cất để cắt giảm chi phí và giảm sự phụ thuộc vào OpenAI
Microsoft đã ra mắt bảy mô hình MAI tại Build 2026, bao gồm một mô hình lý luận phù hợp với Opus 4.6 của Anthropic về mã hóa, tất cả đều được đào tạo từ đầu mà không cần chưng cất.
OpenAI chuẩn bị GPT-5.6 với cửa sổ ngữ cảnh mã thông báo 1,5 triệu và biến thể Pro
OpenAI dự kiến ra mắt GPT-5.6 ngay trong tuần tới, với cửa sổ ngữ cảnh 1,5 triệu mã thông báo, mã hóa đường chân trời dài được cải thiện và các biến thể Mini và Pro nhắm mục tiêu đến Anthropic.

Các mô hình AI của Trung Quốc vượt qua các đối thủ của Hoa Kỳ trong việc sử dụng mã thông báo toàn cầu khi DeepSeek V4 chiếm vị trí hàng đầu
Dữ liệu của OpenRouter cho thấy các mô hình Trung Quốc như DeepSeek V4 Flash và MiniMax M3 hiện thống trị mức tiêu thụ token toàn cầu, khiến ChatGPT và Gemini nằm ngoài top 10.

Zhipu ra mắt GLM 5.2 với tư cách là CEO tranh luận với Elon Musk về dòng thời gian AI biên giới của Trung Quốc
Phòng thí nghiệm AI Trung Quốc Zhipu đã phát hành GLM 5.2 khi Giám đốc điều hành Tang Jie lùi lại mốc thời gian quý 1 năm 2027 của Elon Musk để Trung Quốc đạt được AI cấp Fable.
