Mô hình AI
55 articles
GPT-6 Astra triển khai cho người dùng ChatGPT trả phí khi Altman xin lỗi vì ra mắt lộn xộn
GPT-6 Astra của OpenAI đang tiếp cận hầu hết người dùng trả tiền sau đợt ra mắt hỗn loạn. Sam Altman đã xin lỗi và hứa sẽ đặt lại mức sử dụng cho những người đăng ký bị khóa.
Google ra mắt Gemini 3.8 Flash và một biến thể mạng được xây dựng để tự động phòng chống lỗ hổng bảo mật
Gemini 3.8 Flash của Google cung cấp khả năng mã hóa và lý luận ở mức cao nhất với mức giá 0,75 USD trên một triệu mã thông báo đầu vào, với biến thể Flash Cyber dành cho những người bảo vệ an ninh.
OpenAI bắt đầu tung ra GPT-6 Astra để chọn lọc khách hàng, tuyên bố kỷ nguyên AGI đã đến
OpenAI đã bắt đầu triển khai GPT-6 Astra để chọn lọc khách hàng an ninh mạng, với việc Greg Brockman tuyên bố kỷ nguyên AGI. Đây là người có quyền truy cập và điều gì sẽ xảy ra tiếp theo.
IFM của Abu Dhabi phát hành K2 Horizon: Sáu mô hình mở với đầy đủ dữ liệu và mã đào tạo
IFM ra mắt K2 Horizon: sáu mô hình mở (0,9B đến 375B-A23B) với đầy đủ dữ liệu đào tạo, điểm kiểm tra, nhật ký và mã theo Apache 2.0. Nó bao gồm những gì.
Meta ra mắt Muse Spark 1.3 với các bản nâng cấp đại lý cho mã Muse và API mô hình Meta
Muse Spark 1.3 của Meta triển khai Muse Code và Meta Model API với các nâng cấp quy trình làm việc tự động, đa nhiệm tốt hơn và lý luận tối đa được tổ chức để kiểm tra an toàn.
Google ra mắt Gemini 3.8 Flash và Flash Cyber, bản phát hành mẫu thứ ba sau sáu tuần
Google cung cấp Gemini 3.8 Flash và một biến thể Flash Cyber tập trung vào an ninh mạng, khẳng định hiệu suất mã hóa gần như Opus với mức giá chỉ bằng một phần nhỏ.
Máy tính đa vũ trụ ra mắt Quasar 438B, Mô hình AI xếp hạng cao nhất Châu Âu
Multiverse Computing đã ra mắt Quasar 438B, một mô hình lý luận lớp 400B đạt 43 điểm trên Chỉ số Trí tuệ Phân tích Nhân tạo, kết quả cao nhất so với bất kỳ mô hình Châu Âu nào.
Google chuẩn bị ra mắt Flash Gemini 3.8 ngay sau thứ Tư để thu hẹp khoảng cách mã hóa AI
Google DeepMind có kế hoạch ra mắt Gemini 3.8 Flash ngay sau thứ Tư, WSJ đưa tin, với các thử nghiệm nội bộ cho thấy sự tiến bộ trong mã hóa trong đó Gemini đã vượt qua các đối thủ.
OpenAI xác nhận Astra là mô hình an ninh mạng 'quan trọng' đầu tiên, đặt ra mức phát hành hạn chế
OpenAI xác nhận mô hình Astra sắp ra mắt của họ đã vượt qua ngưỡng an ninh mạng 'quan trọng' và sẽ sớm xuất xưởng với quyền truy cập hạn chế vào các công cụ mạng mạnh mẽ nhất của họ.
Anthropic ra mắt Claude Fable 5.1 và Mythos 5.1: Rẻ hơn 25%, mạnh hơn khi mã hóa Agentic
Claude Fable 5.1 của Anthropic cắt giảm 25% chi phí thông thường và đạt được lợi ích lớn về điểm chuẩn mã hóa tác nhân, trong khi Mythos 5.1 dành cho người dùng có quyền truy cập đáng tin cậy.
Cohere phát hành Parse 5, AI phân tích tài liệu tham số 2,3B được xây dựng để nhập chi phí đầu tiên
Cohere's Parse 5 biến các tệp PDF, trang trình bày và quét thành Markdown có cấu trúc với mô hình tham số 2,3B. Điểm đáng lưu ý: vị trí dẫn đầu điểm chuẩn của nó dựa trên một phần điểm.
Z.ai mở trọng số GLM-5.3 trên khuôn mặt ôm với giấy phép dành cho các siêu quy mô
Z.ai đã phát hành trọng số GLM-5.3 trên Ôm mặt với bối cảnh mã thông báo 1 triệu và giấy phép tùy chỉnh yêu cầu đánh giá bảo mật đối với các nhà cung cấp MaaS trị giá hơn 10 tỷ đô la.
Bản xem trước Hy4 mã nguồn mở của Tencent: MoE tham số 770B với bối cảnh mã thông báo 1M
Nhóm Hunyuan của Tencent đã phát hành bản xem trước Hy4 theo Apache 2.0 - mô hình MoE tham số 770B với 49B tham số hoạt động, ngữ cảnh mã thông báo 1M và hỗ trợ vLLM hàng ngày.
Google cung cấp Gemini 3.5 Transcribe và Omni 1.1 Flash: Hai bản nâng cấp dành cho nhà phát triển AI
Phiên bản Gemini 3.5 mới của Google đạt tỷ lệ lỗi từ 2,6% trong khi Omni 1.1 Flash bổ sung các cảnh video dài 40 giây, nâng cấp 4K và kiểm soát cấp độ khung hình.
Flash Gemini Omni 1.1 của Google bổ sung các điều khiển cấp Studio và đầu ra 4K cho video AI
Google đã phát hành Gemini Omni 1.1 Flash với khả năng mở rộng cảnh lên tới 40 giây, chuyển đổi khung hình từ đầu đến cuối và nâng cấp 4K thông qua API Gemini.
Google ra mắt Gemini 3.5 Transcribe: Nhận dạng giọng nói theo thời gian thực bằng 85 ngôn ngữ
Google đã ra mắt Gemini 3.5 Transcribe với khả năng phát hiện 85 ngôn ngữ, tỷ lệ lỗi phát trực tuyến 4% và phản hồi nhanh hơn 70% so với Chirp 3, triển khai trên các ứng dụng của mình.
Bản xem trước Qwen3.8-Flash-Next của Alibaba Kiến trúc Qwen4 với 6B tham số hoạt động
Qwen3.8-Flash-Next của Alibaba xem trước các thông số Qwen4: 125B với 6B hoạt động, trọng lượng mở và kết quả đánh bại Qwen3.7-Plus với chi phí đào tạo bằng 1/9.
Z.ai ra mắt GLM-5.3-Flash theo giấy phép MIT: Ox Alpha được tiết lộ, Weights Live
GLM-5.3-Flash của Z.ai là mẫu đa phương thức 320B-A18B được MIT cấp phép phục vụ trên các chip AI của Trung Quốc hiện đứng đầu bảng xếp hạng Phân tích nhân tạo với chi phí thấp.
Z.ai xác nhận Ox Alpha là mẫu thuộc dòng GLM và sẽ công bố trọng lượng của nó
Z.ai nói với Bloomberg rằng mô hình tàng hình lan truyền Ox Alpha là một phiên bản mới của dòng GLM và trọng lượng mở sẽ xuất hiện vào tối nay, kết thúc một tuần sốt sắng đoán mò.
Nhà sản xuất của Ox Alpha có thể đã bị lộ mặt: Phân tích chỉ ra GLM của Zhipu
Một thủ thuật chèn nhanh và phân tích nén gzip cho thấy mô hình bí ẩn Ox Alpha của OpenRouter là GLM của Zhipu - nhưng những người hoài nghi phản đối.
DeepSeek bổ sung tầm nhìn cho V4-Flash với mô hình có khả năng chụp ảnh thử nghiệm
DeepSeek cung cấp deepseek-v4-flash-vision-exp với đầu vào hình ảnh, bối cảnh mã thông báo 1M và định giá ở cấp độ Flash, khắc phục điểm mù khét tiếng nhất trong mô hình của nó.
OpenAI giảm giá API GPT-5.6 Sol hơn 20% khi cuộc chiến về giá đạt đến vị trí hàng đầu
OpenAI đã giảm hơn 20% giá dành cho nhà phát triển GPT-5.6 Sol, giảm mã thông báo đầu ra xuống còn 20 USD trên một triệu. Động thái này kết thúc nhiều tháng giữ mức giá hàng đầu.
Ox Alpha: Mô hình AI tàng hình miễn phí của OpenRouter với bối cảnh mã thông báo 1M khởi động Whodunit
Một mô hình biên giới tàng hình miễn phí có tên Ox Alpha đã xuất hiện trên OpenRouter với đầu vào video và bối cảnh mã thông báo 1M, đồng thời cộng đồng AI đang chạy đua để vạch mặt nhà sản xuất nó.
Các mô hình mở Gemma của Google vượt qua 1 tỷ lượt tải xuống với tư cách là các biến thể cộng đồng hàng đầu 100.000
Google cho biết các mô hình mở Gemma của họ đã vượt qua 1 tỷ lượt tải xuống, với hơn 100.000 biến thể cộng đồng, triển khai quỹ đạo với NASA và một trung tâm Awesome Gemma mới.
Ornith-1.5 sánh ngang với Claude Opus 4.8 về điểm chuẩn mã hóa tác nhân với các mô hình tự cải tiến, mở hoàn toàn
Dòng Ornith-1.5 được MIT cấp phép tạo ra các nhiệm vụ đào tạo và giàn giáo của riêng mình - và hạm 397B của nó liên kết với Claude Opus 4.8 trên mã hóa Terminal-Bench 2.1.
Qwen 3.8 27B của Alibaba chạy trên máy tính xách tay và vượt xa các mẫu lớn hơn của chính nó
Qwen 3.8 27B của Alibaba là mẫu thị giác Apache-2.0 chạy trên máy tính xách tay và đánh bại Qwen 3.7-Plus đã đóng — nhưng cài đặt lý luận mặc định của nó sẽ lật đổ mọi thứ.
Mô hình Qwen AI của Alibaba đạt 3 tỷ lượt tải xuống hàng đầu, vượt qua Meta và Google
Các mô hình Qwen của Alibaba đã vượt qua 3 tỷ lượt tải xuống để vượt qua Meta và Google trong việc áp dụng AI nguồn mở, vài tuần sau khi phát hành phiên bản mở Qwen 3.8.
GLM-5.3 của Z.ai tăng gấp đôi khả năng mã hóa và nổi lên với những kỹ năng an ninh mạng đáng kinh ngạc
GLM-5.3 mới của Z.ai mang lại những lợi ích mã hóa rõ rệt và khả năng phát hiện lỗ hổng bảo mật tiên tiến, thu hẹp khoảng cách giữa Anthropic và OpenAI so với giới hạn trọng lượng mở.
Google cung cấp Gemini 3.7 Flash: Công cụ thông minh nhất dành cho mã hóa và đại lý với mức giá chỉ bằng một nửa
Gemini 3.7 Flash của Google ra mắt chỉ ba tuần sau 3.6 Flash với lợi ích lớn về mã hóa và đại lý, cộng với mức giá giới thiệu chỉ bằng một nửa so với phiên bản tiền nhiệm.
DeepSeek ra mắt V4 Pro ở trạng thái sẵn sàng chung, Đại lý khai thác nguồn mở và tăng giá API
Phòng thí nghiệm AI Trung Quốc DeepSeek phát hành V4 Pro dưới dạng bản xem trước, đưa Harness v0.1 trở thành đối thủ nguồn mở của Claude Code và tăng mạnh giá API trước đợt IPO.
xAI ra mắt Grok 4.6, phù hợp với GPT-5.6 Sol trên Frontier Intelligence Index
Grok 4.6 của xAI đạt 61 điểm trên Chỉ số trí tuệ phân tích nhân tạo, ngang bằng với GPT-5.6 Sol với hiệu suất tác nhân nổi bật với chi phí thấp hơn 60%. Hiện có sẵn trong Cursor và Grok Build.
SL2T của Google DeepMind mang tính năng dịch ngôn ngữ ký hiệu sang điện thoại Pixel 11
Google DeepMind đã ra mắt SL2T, một mô hình dịch ngôn ngữ ký hiệu biến ngôn ngữ ký hiệu thành văn bản trên dòng Pixel 11, bắt đầu từ Pixel 11 Pro Fold.
Nvidia xây dựng Nemotron 4 nghìn tỷ tham số để thách thức các mô hình AI nguồn mở hàng đầu
Nvidia đang phát triển Nemotron 4, một mô hình AI nguồn mở với ít nhất một nghìn tỷ tham số, để cạnh tranh với các hệ thống trọng lượng mở hàng đầu. Mô hình này có thể đến vào mùa thu này.
NVIDIA ra mắt Switchyard Nemotron 3.5 Lightning và NeMo cho AI thông minh hơn
Thư viện định tuyến nguồn mở và mô hình mở gồm 30 tỷ tham số mới của NVIDIA hứa hẹn cho sản lượng nhanh hơn gấp 4 lần và thực hiện các tác vụ tác nhân nhanh hơn 30% trên các thiết bị biên, PC và đám mây.
Mark Zuckerberg tuyên chiến với các đối thủ AI khép kín trong Tuyên ngôn siêu trí tuệ với tư cách là nguồn mở Meta Mô hình mạnh mẽ nhất của nó
Mark Zuckerberg của Meta đã xuất bản một tuyên ngôn sâu rộng kêu gọi AI siêu thông minh cho tất cả mọi người, tấn công các đối thủ AI đóng cửa và phát hành phiên bản mở của mô hình mạnh mẽ nhất của Meta.
Meta phát hành Muse Glimmer, mô hình trọng lượng mở 30B chạy tác nhân AI trên GPU tiêu dùng
Meta đã xuất bản Muse Glimmer, một mô hình mở với 30 tỷ tham số trong Apache 2.0, vượt trội hơn Gemma4-31B và Qwen3.6-27B về điểm chuẩn tác nhân khi chạy cục bộ.
OpenAI tạm dừng mô hình Astra sau khi đánh giá gắn cờ khả năng an ninh mạng 'quan trọng'
OpenAI đã tạm dừng phát triển mô hình Astra sắp tới của mình sau khi các thử nghiệm cho thấy nó có thể đạt đến ngưỡng an ninh mạng 'Quan trọng' - mô hình đầu tiên kích hoạt mức rủi ro cao nhất.
ByteDance được cho là đang đào tạo mô hình AI có 10 nghìn tỷ tham số để đối đầu với huyền thoại của Anthropic
Tờ Financial Times đưa tin ByteDance đang xây dựng một mô hình khổng lồ với 10 nghìn tỷ tham số được thiết kế để phù hợp với quy mô của Anthropic's Mythos, tăng cường cuộc đua AI Mỹ-Trung.
OpenAI tạm dừng hoạt động trên mô hình Astra mới vì lo ngại về an ninh mạng nghiêm trọng
OpenAI đã làm chậm quá trình phát triển mẫu Astra sắp ra mắt của mình sau khi thử nghiệm nội bộ cho thấy các khả năng mạng ở cấp độ quan trọng, thắt chặt các biện pháp kiểm soát trước khi phát hành.
Hình ảnh tưởng tượng 2.0 của xAI xếp ngay sau GPT-Image-2 của OpenAI trong Điểm chuẩn đấu trường
xAI đã phát hành Imagine Image 2.0 cho Grok, xếp thứ hai trên toàn cầu về điểm chuẩn Arena sau GPT-Image-2 của OpenAI, với các công cụ chỉnh sửa mới, hỗ trợ đa tham chiếu và các mẫu được cấu hình sẵn.
OpenAI tạm dừng phát triển mô hình Astra sau khi nó đạt đến ngưỡng rủi ro an ninh mạng 'nghiêm trọng'
OpenAI đã tạm dừng các phần phát triển của Astra sau khi các thử nghiệm nội bộ cho thấy nó có thể đạt đến mức rủi ro an ninh mạng cao nhất trong Khung chuẩn bị của mình — mô hình đầu tiên của nó làm như vậy.
ByteDance đang đào tạo mô hình AI có 10 nghìn tỷ tham số để đối đầu với huyền thoại của loài người
ByteDance đang đào tạo một mô hình AI khổng lồ với tối đa 10 nghìn tỷ thông số, gần đạt quy mô ước tính của Mythos 5 của Anthropic và vượt xa các công ty dẫn đầu hiện tại của Trung Quốc.
Mistral's Shieldstral: Mô hình an toàn dành cho tạ mở 3B đọc các chính sách thay vì ghi nhớ chúng
Mistral AI đã phát hành Shieldstral, một công cụ phân loại an toàn trọng lượng mở tham số 3B để đánh giá văn bản và hình ảnh theo các chính sách kiểm duyệt ngôn ngữ đơn giản tại thời điểm suy luận.
Alibaba ra mắt Qwen3.8-Max: Mô hình 2,4 nghìn tỷ tham số cạnh tranh với Claude của Anthropic
Alibaba đã phát hành Qwen3.8-Max, một mô hình có 2,4 nghìn tỷ tham số, chỉ kém Claude của Anthropic về điểm chuẩn, với trọng lượng mở được hứa hẹn trong vài ngày tới.
Mô hình Astra của OpenAI giải quyết 10 bài toán chưa được giải từ lâu bằng các bằng chứng được kiểm tra bằng máy
Mô hình Astra chưa được phát hành của OpenAI đã giải quyết 10 vấn đề mở trong toán học và khoa học máy tính bằng các bằng chứng được xác minh bằng Lean, giới thiệu mô hình chính tiếp theo của nó trước sự xem xét của chính phủ Hoa Kỳ.
Gemini 3.5 Pro xuất hiện trong thử nghiệm mù LM Arena khi Google Nears phát hành
Gemini 3.5 Pro bị trì hoãn của Google đã nhiều lần được phát hiện trong các bài kiểm tra mù của LMSYS Chatbot Arena, báo hiệu việc ra mắt công chúng cuối cùng có thể sắp xảy ra.
Máy tư duy phát hành mô hình trọng lượng mở nhỏ 276B với kích thước bằng một phần tư kích thước hàng đầu của nó
Phòng thí nghiệm máy tư duy đã phát hành Inkling-Small, một mô hình trọng lượng mở có 276 tỷ thông số với hoạt động 12B phù hợp với kích thước hàng đầu của nó bằng một phần tư kích thước - một công ty Hoa Kỳ tham gia cuộc đua trọng lượng mở.
DeepSeek ra mắt bản Beta công khai V4-Flash khi cuộc chiến giá AI của Trung Quốc leo thang
DeepSeek đã phát hành API V4-Flash beta chính thức, với một mô hình được đào tạo lại để đánh bại chiếc V4 Pro hàng đầu của chính họ trên chín điểm chuẩn của đại lý trong khi giảm giá so với các đối thủ Hoa Kỳ.
OpenAI giảm giá mẫu GPT-5.6 lên tới 80% khi các doanh nghiệp ngày càng nhạy cảm với chi phí AI
OpenAI đã giảm giá hai mẫu GPT-5.6 bao gồm Luna, giảm tới 80% chi phí cho mẫu nhỏ hơn khi các doanh nghiệp xem xét kỹ lưỡng chi tiêu cho AI.
Mẫu V4-Flash mới của DeepSeek phù hợp với GPT-5.6 Luna với chi phí thấp hơn 60%
DeepSeek đã phát hành V4-Flash '0731', một mẫu máy có trọng lượng mở gần như ngang bằng với GPT-5.6 Luna của OpenAI về điểm chuẩn trong khi có giá thấp hơn khoảng 60%.
MiniMax của Trung Quốc phát hành mẫu video AI H3 với clip 2K, âm thanh nổi và trọng lượng mở
Công ty khởi nghiệp AI Trung Quốc MiniMax đã ra mắt mô hình tạo video H3 vào ngày 31 tháng 7 năm 2026, cung cấp độ phân giải 2K, âm thanh nổi và trọng lượng mở với mức giá chỉ bằng một phần so với đối thủ cạnh tranh — thách thức trực tiếp Seedance 2.5 của ByteDance.
Google DeepMind ra mắt Gemini Robotics 2 với khả năng điều khiển hình người toàn cơ thể và cộng tác giữa nhiều robot
Google DeepMind đã ra mắt Gemini Robotics 2, một mô hình hành động-ngôn ngữ-tầm nhìn cho phép các robot hình người di chuyển, nắm bắt và điều phối các nhiệm vụ trên toàn bộ cơ thể của chúng.
OpenAI giảm giá API GPT-5.6 lên tới 80% khi các công ty suy nghĩ lại về chi phí AI
OpenAI đã giảm tới 80% giá API GPT-5.6 Luna và Terra vào ngày 30 tháng 7 năm 2026, hạ giá Anthropic khi các doanh nghiệp xem xét kỹ lưỡng chi tiêu suy luận.
OpenAI cho biết GPT-5.6 Sol đánh bại Claude Opus 5 trên ARC-AGI-3 - nhưng chỉ với cài đặt riêng
OpenAI báo cáo GPT-5.6 Sol đạt 38,3% trên ARC-AGI-3 bằng cách sử dụng khả năng suy luận và nén được giữ lại, đứng đầu Claude Opus 5. Nhưng dây nịt chính thức lại kể một câu chuyện khác, gây ra một cuộc tranh luận về tính công bằng của điểm chuẩn.
Phòng thí nghiệm Black Forest công bố FLUX 3: Một mô hình AI duy nhất cho hình ảnh, video, âm thanh và robot
Black Forest Labs đã ra mắt FLUX 3, một mô hình đa phương thức cùng tạo ra hình ảnh, video với âm thanh gốc và dự đoán hành động của robot — được ưa thích hơn Runway Gen-4.5 trong 77% so sánh.
