Mô hình AI

55 articles

GPT-6 Astra triển khai cho người dùng ChatGPT trả phí khi Altman xin lỗi vì ra mắt lộn xộn
Mô hình AI

GPT-6 Astra triển khai cho người dùng ChatGPT trả phí khi Altman xin lỗi vì ra mắt lộn xộn

GPT-6 Astra của OpenAI đang tiếp cận hầu hết người dùng trả tiền sau đợt ra mắt hỗn loạn. Sam Altman đã xin lỗi và hứa sẽ đặt lại mức sử dụng cho những người đăng ký bị khóa.

5 thg 9, 20268 min read
Google ra mắt Gemini 3.8 Flash và một biến thể mạng được xây dựng để tự động phòng chống lỗ hổng bảo mật
Mô hình AI

Google ra mắt Gemini 3.8 Flash và một biến thể mạng được xây dựng để tự động phòng chống lỗ hổng bảo mật

Gemini 3.8 Flash của Google cung cấp khả năng mã hóa và lý luận ở mức cao nhất với mức giá 0,75 USD trên một triệu mã thông báo đầu vào, với biến thể Flash Cyber ​​dành cho những người bảo vệ an ninh.

4 thg 9, 20268 min read
OpenAI bắt đầu tung ra GPT-6 Astra để chọn lọc khách hàng, tuyên bố kỷ nguyên AGI đã đến
Mô hình AI

OpenAI bắt đầu tung ra GPT-6 Astra để chọn lọc khách hàng, tuyên bố kỷ nguyên AGI đã đến

OpenAI đã bắt đầu triển khai GPT-6 Astra để chọn lọc khách hàng an ninh mạng, với việc Greg Brockman tuyên bố kỷ nguyên AGI. Đây là người có quyền truy cập và điều gì sẽ xảy ra tiếp theo.

4 thg 9, 20267 min read
IFM của Abu Dhabi phát hành K2 Horizon: Sáu mô hình mở với đầy đủ dữ liệu và mã đào tạo
Mô hình AI

IFM của Abu Dhabi phát hành K2 Horizon: Sáu mô hình mở với đầy đủ dữ liệu và mã đào tạo

IFM ra mắt K2 Horizon: sáu mô hình mở (0,9B đến 375B-A23B) với đầy đủ dữ liệu đào tạo, điểm kiểm tra, nhật ký và mã theo Apache 2.0. Nó bao gồm những gì.

3 thg 9, 20268 min read
Meta ra mắt Muse Spark 1.3 với các bản nâng cấp đại lý cho mã Muse và API mô hình Meta
Mô hình AI

Meta ra mắt Muse Spark 1.3 với các bản nâng cấp đại lý cho mã Muse và API mô hình Meta

Muse Spark 1.3 của Meta triển khai Muse Code và Meta Model API với các nâng cấp quy trình làm việc tự động, đa nhiệm tốt hơn và lý luận tối đa được tổ chức để kiểm tra an toàn.

3 thg 9, 20267 min read
Google ra mắt Gemini 3.8 Flash và Flash Cyber, bản phát hành mẫu thứ ba sau sáu tuần
Mô hình AI

Google ra mắt Gemini 3.8 Flash và Flash Cyber, bản phát hành mẫu thứ ba sau sáu tuần

Google cung cấp Gemini 3.8 Flash và một biến thể Flash Cyber ​​tập trung vào an ninh mạng, khẳng định hiệu suất mã hóa gần như Opus với mức giá chỉ bằng một phần nhỏ.

2 thg 9, 20268 min read
Máy tính đa vũ trụ ra mắt Quasar 438B, Mô hình AI xếp hạng cao nhất Châu Âu
Mô hình AI

Máy tính đa vũ trụ ra mắt Quasar 438B, Mô hình AI xếp hạng cao nhất Châu Âu

Multiverse Computing đã ra mắt Quasar 438B, một mô hình lý luận lớp 400B đạt 43 điểm trên Chỉ số Trí tuệ Phân tích Nhân tạo, kết quả cao nhất so với bất kỳ mô hình Châu Âu nào.

2 thg 9, 20267 min read
Google chuẩn bị ra mắt Flash Gemini 3.8 ngay sau thứ Tư để thu hẹp khoảng cách mã hóa AI
Mô hình AI

Google chuẩn bị ra mắt Flash Gemini 3.8 ngay sau thứ Tư để thu hẹp khoảng cách mã hóa AI

Google DeepMind có kế hoạch ra mắt Gemini 3.8 Flash ngay sau thứ Tư, WSJ đưa tin, với các thử nghiệm nội bộ cho thấy sự tiến bộ trong mã hóa trong đó Gemini đã vượt qua các đối thủ.

2 thg 9, 20267 min read
OpenAI xác nhận Astra là mô hình an ninh mạng 'quan trọng' đầu tiên, đặt ra mức phát hành hạn chế
Mô hình AI

OpenAI xác nhận Astra là mô hình an ninh mạng 'quan trọng' đầu tiên, đặt ra mức phát hành hạn chế

OpenAI xác nhận mô hình Astra sắp ra mắt của họ đã vượt qua ngưỡng an ninh mạng 'quan trọng' và sẽ sớm xuất xưởng với quyền truy cập hạn chế vào các công cụ mạng mạnh mẽ nhất của họ.

2 thg 9, 20268 min read
Anthropic ra mắt Claude Fable 5.1 và Mythos 5.1: Rẻ hơn 25%, mạnh hơn khi mã hóa Agentic
Mô hình AI

Anthropic ra mắt Claude Fable 5.1 và Mythos 5.1: Rẻ hơn 25%, mạnh hơn khi mã hóa Agentic

Claude Fable 5.1 của Anthropic cắt giảm 25% chi phí thông thường và đạt được lợi ích lớn về điểm chuẩn mã hóa tác nhân, trong khi Mythos 5.1 dành cho người dùng có quyền truy cập đáng tin cậy.

1 thg 9, 20269 min read
Cohere phát hành Parse 5, AI phân tích tài liệu tham số 2,3B được xây dựng để nhập chi phí đầu tiên
Mô hình AI

Cohere phát hành Parse 5, AI phân tích tài liệu tham số 2,3B được xây dựng để nhập chi phí đầu tiên

Cohere's Parse 5 biến các tệp PDF, trang trình bày và quét thành Markdown có cấu trúc với mô hình tham số 2,3B. Điểm đáng lưu ý: vị trí dẫn đầu điểm chuẩn của nó dựa trên một phần điểm.

30 thg 8, 20267 min read
Z.ai mở trọng số GLM-5.3 trên khuôn mặt ôm với giấy phép dành cho các siêu quy mô
Mô hình AI

Z.ai mở trọng số GLM-5.3 trên khuôn mặt ôm với giấy phép dành cho các siêu quy mô

Z.ai đã phát hành trọng số GLM-5.3 trên Ôm mặt với bối cảnh mã thông báo 1 triệu và giấy phép tùy chỉnh yêu cầu đánh giá bảo mật đối với các nhà cung cấp MaaS trị giá hơn 10 tỷ đô la.

29 thg 8, 20268 min read
Bản xem trước Hy4 mã nguồn mở của Tencent: MoE tham số 770B với bối cảnh mã thông báo 1M
Mô hình AI

Bản xem trước Hy4 mã nguồn mở của Tencent: MoE tham số 770B với bối cảnh mã thông báo 1M

Nhóm Hunyuan của Tencent đã phát hành bản xem trước Hy4 theo Apache 2.0 - mô hình MoE tham số 770B với 49B tham số hoạt động, ngữ cảnh mã thông báo 1M và hỗ trợ vLLM hàng ngày.

28 thg 8, 20268 min read
Google cung cấp Gemini 3.5 Transcribe và Omni 1.1 Flash: Hai bản nâng cấp dành cho nhà phát triển AI
Mô hình AI

Google cung cấp Gemini 3.5 Transcribe và Omni 1.1 Flash: Hai bản nâng cấp dành cho nhà phát triển AI

Phiên bản Gemini 3.5 mới của Google đạt tỷ lệ lỗi từ 2,6% trong khi Omni 1.1 Flash bổ sung các cảnh video dài 40 giây, nâng cấp 4K và kiểm soát cấp độ khung hình.

28 thg 8, 202610 min read
Flash Gemini Omni 1.1 của Google bổ sung các điều khiển cấp Studio và đầu ra 4K cho video AI
Mô hình AI

Flash Gemini Omni 1.1 của Google bổ sung các điều khiển cấp Studio và đầu ra 4K cho video AI

Google đã phát hành Gemini Omni 1.1 Flash với khả năng mở rộng cảnh lên tới 40 giây, chuyển đổi khung hình từ đầu đến cuối và nâng cấp 4K thông qua API Gemini.

27 thg 8, 20267 min read
Google ra mắt Gemini 3.5 Transcribe: Nhận dạng giọng nói theo thời gian thực bằng 85 ngôn ngữ
Mô hình AI

Google ra mắt Gemini 3.5 Transcribe: Nhận dạng giọng nói theo thời gian thực bằng 85 ngôn ngữ

Google đã ra mắt Gemini 3.5 Transcribe với khả năng phát hiện 85 ngôn ngữ, tỷ lệ lỗi phát trực tuyến 4% và phản hồi nhanh hơn 70% so với Chirp 3, triển khai trên các ứng dụng của mình.

27 thg 8, 20269 min read
Bản xem trước Qwen3.8-Flash-Next của Alibaba Kiến trúc Qwen4 với 6B tham số hoạt động
Mô hình AI

Bản xem trước Qwen3.8-Flash-Next của Alibaba Kiến trúc Qwen4 với 6B tham số hoạt động

Qwen3.8-Flash-Next của Alibaba xem trước các thông số Qwen4: 125B với 6B hoạt động, trọng lượng mở và kết quả đánh bại Qwen3.7-Plus với chi phí đào tạo bằng 1/9.

26 thg 8, 20267 min read
Z.ai ra mắt GLM-5.3-Flash theo giấy phép MIT: Ox Alpha được tiết lộ, Weights Live
Mô hình AI

Z.ai ra mắt GLM-5.3-Flash theo giấy phép MIT: Ox Alpha được tiết lộ, Weights Live

GLM-5.3-Flash của Z.ai là mẫu đa phương thức 320B-A18B được MIT cấp phép phục vụ trên các chip AI của Trung Quốc hiện đứng đầu bảng xếp hạng Phân tích nhân tạo với chi phí thấp.

26 thg 8, 20267 min read
Z.ai xác nhận Ox Alpha là mẫu thuộc dòng GLM và sẽ công bố trọng lượng của nó
Mô hình AI

Z.ai xác nhận Ox Alpha là mẫu thuộc dòng GLM và sẽ công bố trọng lượng của nó

Z.ai nói với Bloomberg rằng mô hình tàng hình lan truyền Ox Alpha là một phiên bản mới của dòng GLM và trọng lượng mở sẽ xuất hiện vào tối nay, kết thúc một tuần sốt sắng đoán mò.

26 thg 8, 20267 min read
Nhà sản xuất của Ox Alpha có thể đã bị lộ mặt: Phân tích chỉ ra GLM của Zhipu
Mô hình AI

Nhà sản xuất của Ox Alpha có thể đã bị lộ mặt: Phân tích chỉ ra GLM của Zhipu

Một thủ thuật chèn nhanh và phân tích nén gzip cho thấy mô hình bí ẩn Ox Alpha của OpenRouter là GLM của Zhipu - nhưng những người hoài nghi phản đối.

25 thg 8, 20267 min read
DeepSeek bổ sung tầm nhìn cho V4-Flash với mô hình có khả năng chụp ảnh thử nghiệm
Mô hình AI

DeepSeek bổ sung tầm nhìn cho V4-Flash với mô hình có khả năng chụp ảnh thử nghiệm

DeepSeek cung cấp deepseek-v4-flash-vision-exp với đầu vào hình ảnh, bối cảnh mã thông báo 1M và định giá ở cấp độ Flash, khắc phục điểm mù khét tiếng nhất trong mô hình của nó.

22 thg 8, 20268 min read
OpenAI giảm giá API GPT-5.6 Sol hơn 20% khi cuộc chiến về giá đạt đến vị trí hàng đầu
Mô hình AI

OpenAI giảm giá API GPT-5.6 Sol hơn 20% khi cuộc chiến về giá đạt đến vị trí hàng đầu

OpenAI đã giảm hơn 20% giá dành cho nhà phát triển GPT-5.6 Sol, giảm mã thông báo đầu ra xuống còn 20 USD trên một triệu. Động thái này kết thúc nhiều tháng giữ mức giá hàng đầu.

22 thg 8, 20267 min read
Ox Alpha: Mô hình AI tàng hình miễn phí của OpenRouter với bối cảnh mã thông báo 1M khởi động Whodunit
Mô hình AI

Ox Alpha: Mô hình AI tàng hình miễn phí của OpenRouter với bối cảnh mã thông báo 1M khởi động Whodunit

Một mô hình biên giới tàng hình miễn phí có tên Ox Alpha đã xuất hiện trên OpenRouter với đầu vào video và bối cảnh mã thông báo 1M, đồng thời cộng đồng AI đang chạy đua để vạch mặt nhà sản xuất nó.

21 thg 8, 20269 min read
Các mô hình mở Gemma của Google vượt qua 1 tỷ lượt tải xuống với tư cách là các biến thể cộng đồng hàng đầu 100.000
Mô hình AI

Các mô hình mở Gemma của Google vượt qua 1 tỷ lượt tải xuống với tư cách là các biến thể cộng đồng hàng đầu 100.000

Google cho biết các mô hình mở Gemma của họ đã vượt qua 1 tỷ lượt tải xuống, với hơn 100.000 biến thể cộng đồng, triển khai quỹ đạo với NASA và một trung tâm Awesome Gemma mới.

21 thg 8, 20266 min read
Ornith-1.5 sánh ngang với Claude Opus 4.8 về điểm chuẩn mã hóa tác nhân với các mô hình tự cải tiến, mở hoàn toàn
Mô hình AI

Ornith-1.5 sánh ngang với Claude Opus 4.8 về điểm chuẩn mã hóa tác nhân với các mô hình tự cải tiến, mở hoàn toàn

Dòng Ornith-1.5 được MIT cấp phép tạo ra các nhiệm vụ đào tạo và giàn giáo của riêng mình - và hạm 397B của nó liên kết với Claude Opus 4.8 trên mã hóa Terminal-Bench 2.1.

20 thg 8, 20267 min read
Qwen 3.8 27B của Alibaba chạy trên máy tính xách tay và vượt xa các mẫu lớn hơn của chính nó
Mô hình AI

Qwen 3.8 27B của Alibaba chạy trên máy tính xách tay và vượt xa các mẫu lớn hơn của chính nó

Qwen 3.8 27B của Alibaba là mẫu thị giác Apache-2.0 chạy trên máy tính xách tay và đánh bại Qwen 3.7-Plus đã đóng — nhưng cài đặt lý luận mặc định của nó sẽ lật đổ mọi thứ.

17 thg 8, 20268 min read
Mô hình Qwen AI của Alibaba đạt 3 tỷ lượt tải xuống hàng đầu, vượt qua Meta và Google
Mô hình AI

Mô hình Qwen AI của Alibaba đạt 3 tỷ lượt tải xuống hàng đầu, vượt qua Meta và Google

Các mô hình Qwen của Alibaba đã vượt qua 3 tỷ lượt tải xuống để vượt qua Meta và Google trong việc áp dụng AI nguồn mở, vài tuần sau khi phát hành phiên bản mở Qwen 3.8.

15 thg 8, 20267 min read
GLM-5.3 của Z.ai tăng gấp đôi khả năng mã hóa và nổi lên với những kỹ năng an ninh mạng đáng kinh ngạc
Mô hình AI

GLM-5.3 của Z.ai tăng gấp đôi khả năng mã hóa và nổi lên với những kỹ năng an ninh mạng đáng kinh ngạc

GLM-5.3 mới của Z.ai mang lại những lợi ích mã hóa rõ rệt và khả năng phát hiện lỗ hổng bảo mật tiên tiến, thu hẹp khoảng cách giữa Anthropic và OpenAI so với giới hạn trọng lượng mở.

14 thg 8, 20267 min read
Google cung cấp Gemini 3.7 Flash: Công cụ thông minh nhất dành cho mã hóa và đại lý với mức giá chỉ bằng một nửa
Mô hình AI

Google cung cấp Gemini 3.7 Flash: Công cụ thông minh nhất dành cho mã hóa và đại lý với mức giá chỉ bằng một nửa

Gemini 3.7 Flash của Google ra mắt chỉ ba tuần sau 3.6 Flash với lợi ích lớn về mã hóa và đại lý, cộng với mức giá giới thiệu chỉ bằng một nửa so với phiên bản tiền nhiệm.

13 thg 8, 20266 min read
DeepSeek ra mắt V4 Pro ở trạng thái sẵn sàng chung, Đại lý khai thác nguồn mở và tăng giá API
Mô hình AI

DeepSeek ra mắt V4 Pro ở trạng thái sẵn sàng chung, Đại lý khai thác nguồn mở và tăng giá API

Phòng thí nghiệm AI Trung Quốc DeepSeek phát hành V4 Pro dưới dạng bản xem trước, đưa Harness v0.1 trở thành đối thủ nguồn mở của Claude Code và tăng mạnh giá API trước đợt IPO.

13 thg 8, 20267 min read
xAI ra mắt Grok 4.6, phù hợp với GPT-5.6 Sol trên Frontier Intelligence Index
Mô hình AI

xAI ra mắt Grok 4.6, phù hợp với GPT-5.6 Sol trên Frontier Intelligence Index

Grok 4.6 của xAI đạt 61 điểm trên Chỉ số trí tuệ phân tích nhân tạo, ngang bằng với GPT-5.6 Sol với hiệu suất tác nhân nổi bật với chi phí thấp hơn 60%. Hiện có sẵn trong Cursor và Grok Build.

12 thg 8, 20266 min read
SL2T của Google DeepMind mang tính năng dịch ngôn ngữ ký hiệu sang điện thoại Pixel 11
Mô hình AI

SL2T của Google DeepMind mang tính năng dịch ngôn ngữ ký hiệu sang điện thoại Pixel 11

Google DeepMind đã ra mắt SL2T, một mô hình dịch ngôn ngữ ký hiệu biến ngôn ngữ ký hiệu thành văn bản trên dòng Pixel 11, bắt đầu từ Pixel 11 Pro Fold.

12 thg 8, 20267 min read
Nvidia xây dựng Nemotron 4 nghìn tỷ tham số để thách thức các mô hình AI nguồn mở hàng đầu
Mô hình AI

Nvidia xây dựng Nemotron 4 nghìn tỷ tham số để thách thức các mô hình AI nguồn mở hàng đầu

Nvidia đang phát triển Nemotron 4, một mô hình AI nguồn mở với ít nhất một nghìn tỷ tham số, để cạnh tranh với các hệ thống trọng lượng mở hàng đầu. Mô hình này có thể đến vào mùa thu này.

12 thg 8, 20266 min read
NVIDIA ra mắt Switchyard Nemotron 3.5 Lightning và NeMo cho AI thông minh hơn
Mô hình AI

NVIDIA ra mắt Switchyard Nemotron 3.5 Lightning và NeMo cho AI thông minh hơn

Thư viện định tuyến nguồn mở và mô hình mở gồm 30 tỷ tham số mới của NVIDIA hứa hẹn cho sản lượng nhanh hơn gấp 4 lần và thực hiện các tác vụ tác nhân nhanh hơn 30% trên các thiết bị biên, PC và đám mây.

11 thg 8, 20268 min read
Mark Zuckerberg tuyên chiến với các đối thủ AI khép kín trong Tuyên ngôn siêu trí tuệ với tư cách là nguồn mở Meta Mô hình mạnh mẽ nhất của nó
Mô hình AI

Mark Zuckerberg tuyên chiến với các đối thủ AI khép kín trong Tuyên ngôn siêu trí tuệ với tư cách là nguồn mở Meta Mô hình mạnh mẽ nhất của nó

Mark Zuckerberg của Meta đã xuất bản một tuyên ngôn sâu rộng kêu gọi AI siêu thông minh cho tất cả mọi người, tấn công các đối thủ AI đóng cửa và phát hành phiên bản mở của mô hình mạnh mẽ nhất của Meta.

11 thg 8, 20267 min read
Meta phát hành Muse Glimmer, mô hình trọng lượng mở 30B chạy tác nhân AI trên GPU tiêu dùng
Mô hình AI

Meta phát hành Muse Glimmer, mô hình trọng lượng mở 30B chạy tác nhân AI trên GPU tiêu dùng

Meta đã xuất bản Muse Glimmer, một mô hình mở với 30 tỷ tham số trong Apache 2.0, vượt trội hơn Gemma4-31B và Qwen3.6-27B về điểm chuẩn tác nhân khi chạy cục bộ.

10 thg 8, 20267 min read
OpenAI tạm dừng mô hình Astra sau khi đánh giá gắn cờ khả năng an ninh mạng 'quan trọng'
Mô hình AI

OpenAI tạm dừng mô hình Astra sau khi đánh giá gắn cờ khả năng an ninh mạng 'quan trọng'

OpenAI đã tạm dừng phát triển mô hình Astra sắp tới của mình sau khi các thử nghiệm cho thấy nó có thể đạt đến ngưỡng an ninh mạng 'Quan trọng' - mô hình đầu tiên kích hoạt mức rủi ro cao nhất.

10 thg 8, 20268 min read
ByteDance được cho là đang đào tạo mô hình AI có 10 nghìn tỷ tham số để đối đầu với huyền thoại của Anthropic
Mô hình AI

ByteDance được cho là đang đào tạo mô hình AI có 10 nghìn tỷ tham số để đối đầu với huyền thoại của Anthropic

Tờ Financial Times đưa tin ByteDance đang xây dựng một mô hình khổng lồ với 10 nghìn tỷ tham số được thiết kế để phù hợp với quy mô của Anthropic's Mythos, tăng cường cuộc đua AI Mỹ-Trung.

9 thg 8, 20267 min read
OpenAI tạm dừng hoạt động trên mô hình Astra mới vì lo ngại về an ninh mạng nghiêm trọng
Mô hình AI

OpenAI tạm dừng hoạt động trên mô hình Astra mới vì lo ngại về an ninh mạng nghiêm trọng

OpenAI đã làm chậm quá trình phát triển mẫu Astra sắp ra mắt của mình sau khi thử nghiệm nội bộ cho thấy các khả năng mạng ở cấp độ quan trọng, thắt chặt các biện pháp kiểm soát trước khi phát hành.

9 thg 8, 20268 min read
Hình ảnh tưởng tượng 2.0 của xAI xếp ngay sau GPT-Image-2 của OpenAI trong Điểm chuẩn đấu trường
Mô hình AI

Hình ảnh tưởng tượng 2.0 của xAI xếp ngay sau GPT-Image-2 của OpenAI trong Điểm chuẩn đấu trường

xAI đã phát hành Imagine Image 2.0 cho Grok, xếp thứ hai trên toàn cầu về điểm chuẩn Arena sau GPT-Image-2 của OpenAI, với các công cụ chỉnh sửa mới, hỗ trợ đa tham chiếu và các mẫu được cấu hình sẵn.

8 thg 8, 20267 min read
OpenAI tạm dừng phát triển mô hình Astra sau khi nó đạt đến ngưỡng rủi ro an ninh mạng 'nghiêm trọng'
Mô hình AI

OpenAI tạm dừng phát triển mô hình Astra sau khi nó đạt đến ngưỡng rủi ro an ninh mạng 'nghiêm trọng'

OpenAI đã tạm dừng các phần phát triển của Astra sau khi các thử nghiệm nội bộ cho thấy nó có thể đạt đến mức rủi ro an ninh mạng cao nhất trong Khung chuẩn bị của mình — mô hình đầu tiên của nó làm như vậy.

8 thg 8, 20267 min read
ByteDance đang đào tạo mô hình AI có 10 nghìn tỷ tham số để đối đầu với huyền thoại của loài người
Mô hình AI

ByteDance đang đào tạo mô hình AI có 10 nghìn tỷ tham số để đối đầu với huyền thoại của loài người

ByteDance đang đào tạo một mô hình AI khổng lồ với tối đa 10 nghìn tỷ thông số, gần đạt quy mô ước tính của Mythos 5 của Anthropic và vượt xa các công ty dẫn đầu hiện tại của Trung Quốc.

7 thg 8, 20267 min read
Mistral's Shieldstral: Mô hình an toàn dành cho tạ mở 3B đọc các chính sách thay vì ghi nhớ chúng
Mô hình AI

Mistral's Shieldstral: Mô hình an toàn dành cho tạ mở 3B đọc các chính sách thay vì ghi nhớ chúng

Mistral AI đã phát hành Shieldstral, một công cụ phân loại an toàn trọng lượng mở tham số 3B để đánh giá văn bản và hình ảnh theo các chính sách kiểm duyệt ngôn ngữ đơn giản tại thời điểm suy luận.

5 thg 8, 20267 min read
Alibaba ra mắt Qwen3.8-Max: Mô hình 2,4 nghìn tỷ tham số cạnh tranh với Claude của Anthropic
Mô hình AI

Alibaba ra mắt Qwen3.8-Max: Mô hình 2,4 nghìn tỷ tham số cạnh tranh với Claude của Anthropic

Alibaba đã phát hành Qwen3.8-Max, một mô hình có 2,4 nghìn tỷ tham số, chỉ kém Claude của Anthropic về điểm chuẩn, với trọng lượng mở được hứa hẹn trong vài ngày tới.

3 thg 8, 20266 min read
Mô hình Astra của OpenAI giải quyết 10 bài toán chưa được giải từ lâu bằng các bằng chứng được kiểm tra bằng máy
Mô hình AI

Mô hình Astra của OpenAI giải quyết 10 bài toán chưa được giải từ lâu bằng các bằng chứng được kiểm tra bằng máy

Mô hình Astra chưa được phát hành của OpenAI đã giải quyết 10 vấn đề mở trong toán học và khoa học máy tính bằng các bằng chứng được xác minh bằng Lean, giới thiệu mô hình chính tiếp theo của nó trước sự xem xét của chính phủ Hoa Kỳ.

3 thg 8, 20267 min read
Gemini 3.5 Pro xuất hiện trong thử nghiệm mù LM Arena khi Google Nears phát hành
Mô hình AI

Gemini 3.5 Pro xuất hiện trong thử nghiệm mù LM Arena khi Google Nears phát hành

Gemini 3.5 Pro bị trì hoãn của Google đã nhiều lần được phát hiện trong các bài kiểm tra mù của LMSYS Chatbot Arena, báo hiệu việc ra mắt công chúng cuối cùng có thể sắp xảy ra.

2 thg 8, 20267 min read
Máy tư duy phát hành mô hình trọng lượng mở nhỏ 276B với kích thước bằng một phần tư kích thước hàng đầu của nó
Mô hình AI

Máy tư duy phát hành mô hình trọng lượng mở nhỏ 276B với kích thước bằng một phần tư kích thước hàng đầu của nó

Phòng thí nghiệm máy tư duy đã phát hành Inkling-Small, một mô hình trọng lượng mở có 276 tỷ thông số với hoạt động 12B phù hợp với kích thước hàng đầu của nó bằng một phần tư kích thước - một công ty Hoa Kỳ tham gia cuộc đua trọng lượng mở.

2 thg 8, 20267 min read
DeepSeek ra mắt bản Beta công khai V4-Flash khi cuộc chiến giá AI của Trung Quốc leo thang
Mô hình AI

DeepSeek ra mắt bản Beta công khai V4-Flash khi cuộc chiến giá AI của Trung Quốc leo thang

DeepSeek đã phát hành API V4-Flash beta chính thức, với một mô hình được đào tạo lại để đánh bại chiếc V4 Pro hàng đầu của chính họ trên chín điểm chuẩn của đại lý trong khi giảm giá so với các đối thủ Hoa Kỳ.

1 thg 8, 20268 min read
OpenAI giảm giá mẫu GPT-5.6 lên tới 80% khi các doanh nghiệp ngày càng nhạy cảm với chi phí AI
Mô hình AI

OpenAI giảm giá mẫu GPT-5.6 lên tới 80% khi các doanh nghiệp ngày càng nhạy cảm với chi phí AI

OpenAI đã giảm giá hai mẫu GPT-5.6 bao gồm Luna, giảm tới 80% chi phí cho mẫu nhỏ hơn khi các doanh nghiệp xem xét kỹ lưỡng chi tiêu cho AI.

1 thg 8, 20267 min read
Mẫu V4-Flash mới của DeepSeek phù hợp với GPT-5.6 Luna với chi phí thấp hơn 60%
Mô hình AI

Mẫu V4-Flash mới của DeepSeek phù hợp với GPT-5.6 Luna với chi phí thấp hơn 60%

DeepSeek đã phát hành V4-Flash '0731', một mẫu máy có trọng lượng mở gần như ngang bằng với GPT-5.6 Luna của OpenAI về điểm chuẩn trong khi có giá thấp hơn khoảng 60%.

31 thg 7, 20266 min read
MiniMax của Trung Quốc phát hành mẫu video AI H3 với clip 2K, âm thanh nổi và trọng lượng mở
Mô hình AI

MiniMax của Trung Quốc phát hành mẫu video AI H3 với clip 2K, âm thanh nổi và trọng lượng mở

Công ty khởi nghiệp AI Trung Quốc MiniMax đã ra mắt mô hình tạo video H3 vào ngày 31 tháng 7 năm 2026, cung cấp độ phân giải 2K, âm thanh nổi và trọng lượng mở với mức giá chỉ bằng một phần so với đối thủ cạnh tranh — thách thức trực tiếp Seedance 2.5 của ByteDance.

31 thg 7, 20268 min read
Google DeepMind ra mắt Gemini Robotics 2 với khả năng điều khiển hình người toàn cơ thể và cộng tác giữa nhiều robot
Mô hình AI

Google DeepMind ra mắt Gemini Robotics 2 với khả năng điều khiển hình người toàn cơ thể và cộng tác giữa nhiều robot

Google DeepMind đã ra mắt Gemini Robotics 2, một mô hình hành động-ngôn ngữ-tầm nhìn cho phép các robot hình người di chuyển, nắm bắt và điều phối các nhiệm vụ trên toàn bộ cơ thể của chúng.

31 thg 7, 20267 min read
OpenAI giảm giá API GPT-5.6 lên tới 80% khi các công ty suy nghĩ lại về chi phí AI
Mô hình AI

OpenAI giảm giá API GPT-5.6 lên tới 80% khi các công ty suy nghĩ lại về chi phí AI

OpenAI đã giảm tới 80% giá API GPT-5.6 Luna và Terra vào ngày 30 tháng 7 năm 2026, hạ giá Anthropic khi các doanh nghiệp xem xét kỹ lưỡng chi tiêu suy luận.

30 thg 7, 20267 min read
OpenAI cho biết GPT-5.6 Sol đánh bại Claude Opus 5 trên ARC-AGI-3 - nhưng chỉ với cài đặt riêng
Mô hình AI

OpenAI cho biết GPT-5.6 Sol đánh bại Claude Opus 5 trên ARC-AGI-3 - nhưng chỉ với cài đặt riêng

OpenAI báo cáo GPT-5.6 Sol đạt 38,3% trên ARC-AGI-3 bằng cách sử dụng khả năng suy luận và nén được giữ lại, đứng đầu Claude Opus 5. Nhưng dây nịt chính thức lại kể một câu chuyện khác, gây ra một cuộc tranh luận về tính công bằng của điểm chuẩn.

30 thg 7, 20265 min read
Phòng thí nghiệm Black Forest công bố FLUX 3: Một mô hình AI duy nhất cho hình ảnh, video, âm thanh và robot
Mô hình AI

Phòng thí nghiệm Black Forest công bố FLUX 3: Một mô hình AI duy nhất cho hình ảnh, video, âm thanh và robot

Black Forest Labs đã ra mắt FLUX 3, một mô hình đa phương thức cùng tạo ra hình ảnh, video với âm thanh gốc và dự đoán hành động của robot — được ưa thích hơn Runway Gen-4.5 trong 77% so sánh.

26 thg 7, 20268 min read