AI 모델
54 articles
Google, 자동화된 취약점 방어를 위해 구축된 Gemini 3.8 플래시 및 사이버 변종 출시
Google의 Gemini 3.8 Flash는 보안 방어자를 위한 Flash Cyber 변형과 함께 입력 토큰 백만 개당 0.75달러의 비용으로 최전선 수준의 코딩 및 추론을 제공합니다.
OpenAI, 일부 고객에게 GPT-6 Astra 출시 시작, AGI 시대 도래 선언
OpenAI는 Greg Brockman이 AGI 시대를 선언하면서 사이버 보안 고객을 선택하기 위해 GPT-6 Astra를 출시하기 시작했습니다. 액세스할 수 있는 사람과 다음 단계는 다음과 같습니다.
아부다비의 IFM, K2 Horizon 출시: 전체 훈련 데이터 및 코드를 갖춘 6개의 개방형 모델
IFM은 Apache 2.0에서 전체 훈련 데이터, 체크포인트, 로그 및 코드를 갖춘 6개의 개방형 모델(0.9B ~ 375B-A23B)인 K2 Horizon을 출시했습니다. 포함 내용.
Meta, Muse 코드 및 메타 모델 API에 대한 에이전트적 업그레이드가 포함된 Muse Spark 1.3 출시
Meta의 Muse Spark 1.3은 에이전트 워크플로우 업그레이드, 향상된 멀티태스킹 및 안전 테스트를 위한 최대 추론 기능을 갖춘 Muse Code 및 Meta Model API에 출시됩니다.
Google, 6주 만에 세 번째 모델 출시인 Gemini 3.8 Flash 및 Flash Cyber 출시
Google은 Gemini 3.8 Flash와 사이버 보안에 초점을 맞춘 Flash Cyber 변형을 출시하여 저렴한 가격으로 Opus에 가까운 코딩 성능을 제공합니다.
멀티버스 컴퓨팅(Multiverse Computing), 유럽 최고 수준의 AI 모델인 Quasar 438B 출시
멀티버스 컴퓨팅(Multiverse Computing)은 인공 분석 지능 지수(Artificial Analysis Intelligence Index)에서 유럽 모델 중 최고 점수인 43점을 획득한 400B급 추론 모델인 Quasar 438B를 출시했습니다.
Google은 AI 코딩 격차를 줄이기 위해 수요일에 Gemini 3.8 플래시 출시를 준비합니다.
Google DeepMind는 빠르면 수요일에 Gemini 3.8 Flash를 출시할 계획이라고 WSJ는 보도했습니다. 내부 테스트에서는 Gemini가 경쟁사에 뒤처진 코딩 진행 상황을 보여주었습니다.
OpenAI, Astra가 최초의 '핵심' 사이버 보안 모델임을 확인하고 제한된 릴리스 설정
OpenAI는 곧 출시될 Astra 모델이 '중요한' 사이버 보안 임계값을 넘어섰으며 가장 강력한 사이버 도구에 대한 액세스가 제한된 상태로 곧 출시될 것이라고 확인했습니다.
Anthropic, Claude Fable 5.1 및 Mythos 5.1 출시: 25% 더 저렴하고 Agentic Coding이 더 강력함
Anthropic의 Claude Fable 5.1은 일반 비용을 25% 절감하고 에이전트 코딩 벤치마크에서 큰 이점을 제공하며, Mythos 5.1은 신뢰할 수 있는 액세스 사용자를 위해 출시되었습니다.
Cohere, 비용 우선 수집을 위해 구축된 2.3B 매개변수 문서 구문 분석 AI인 Parse 5 출시
Cohere의 Parse 5는 PDF, 슬라이드 및 스캔을 2.3B 매개변수 모델을 사용하여 구조화된 Markdown으로 변환합니다. 문제점: 벤치마크 선두가 부분 점수에 달려 있습니다.
Z.ai, 하이퍼스케일러를 겨냥한 라이선스로 포옹 얼굴에 GLM-5.3 가중치 공개
Z.ai는 100만 토큰 컨텍스트와 100억 달러 이상의 MaaS 제공업체에 대한 보안 검토가 필요한 맞춤형 라이센스를 갖춘 Hugging Face에 대한 GLM-5.3 가중치를 출시했습니다.
Tencent 오픈 소스 Hy4 미리보기: 1M 토큰 컨텍스트를 갖춘 770B 매개변수 MoE
Tencent의 Hunyuan 팀은 49B 활성 매개변수, 1M 토큰 컨텍스트 및 1일차 vLLM 지원을 갖춘 770B 매개변수 MoE 모델인 Apache 2.0에서 Hy4 미리 보기를 출시했습니다.
Google, Gemini 3.5 Transcribe 및 Omni 1.1 Flash 출시: AI 개발자를 위한 두 가지 업그레이드
Google의 새로운 Gemini 3.5 Transcribe는 2.6%의 단어 오류율을 달성했으며 Omni 1.1 Flash에는 40초 비디오 장면, 4K 업스케일링 및 프레임 수준 제어가 추가되었습니다.
Google의 Gemini Omni 1.1 Flash는 AI 비디오에 스튜디오급 컨트롤과 4K 출력을 추가합니다.
Google은 최대 40초의 장면 확장, 시작 및 끝 프레임 전환, Gemini API를 통한 4K 업스케일링 기능을 갖춘 Gemini Omni 1.1 Flash를 출시했습니다.
Google, Gemini 3.5 Transcribe 출시: 85개 언어로 실시간 음성 인식
Google은 85개 언어 감지, 4% 스트리밍 오류율 및 Chirp 3보다 70% 더 빠른 응답 기능을 갖춘 Gemini 3.5 Transcribe를 출시하여 앱 전체에 출시했습니다.
Alibaba의 Qwen3.8-Flash-Next, 6B 활성 매개변수를 갖춘 Qwen4 아키텍처 미리보기
Alibaba의 Qwen3.8-Flash-Next는 Qwen4를 미리 보여줍니다. 6B 활성, 개방형 가중치 및 Qwen3.7-Plus를 능가하는 결과를 1/9의 교육 비용으로 제공합니다.
Z.ai, MIT 라이센스에 따라 GLM-5.3-Flash 출시: Ox Alpha 공개, Weights Live
Z.ai의 GLM-5.3-Flash는 중국 AI 칩에서 제공되는 320B-A18B MIT 라이센스 다중 모드 모델로, 현재 저렴한 비용으로 인공 분석 순위 1위를 차지하고 있습니다.
Z.ai, Ox Alpha가 GLM 시리즈 모델임을 확인하고 무게를 공개할 예정
Z.ai는 블룸버그에 바이러스 스텔스 모델 Ox Alpha가 새로운 GLM 시리즈 릴리스이며 오늘 밤 오픈 웨이트가 도착하여 일주일 간의 열띤 추측이 끝났다고 말했습니다.
Ox Alpha의 제작자는 가면이 벗겨졌을 수 있습니다: Zhipu의 GLM에 대한 분석 포인트
신속한 주입 트릭과 gzip 압축 분석을 통해 OpenRouter의 미스터리 모델 Ox Alpha가 Zhipu의 GLM임을 암시하지만 회의론자들은 이를 거부합니다.
DeepSeek, 실험적인 이미지 가능 모델을 통해 V4-Flash에 비전 추가
DeepSeek은 이미지 입력, 1M 토큰 컨텍스트 및 플래시 수준 가격을 갖춘 deepseek-v4-flash-vision-exp를 제공하여 모델의 가장 악명 높은 사각지대를 수정합니다.
OpenAI, 가격 전쟁이 주력에 도달함에 따라 GPT-5.6 Sol API 가격을 20% 이상 인하
OpenAI는 GPT-5.6 Sol 개발자 가격을 20% 이상 인하하여 출력 토큰을 백만 달러당 20달러로 낮췄습니다. 이번 움직임은 몇 달 동안 주력 가격을 유지하는 기간을 종료합니다.
Ox Alpha: 1M 토큰 컨텍스트를 갖춘 OpenRouter의 무료 스텔스 AI 모델이 Whodunit을 시작합니다
Ox Alpha라는 무료 스텔스 프론티어 모델이 1M 토큰 컨텍스트와 비디오 입력을 갖춘 OpenRouter에 등장했으며 AI 커뮤니티는 해당 모델의 정체를 밝히기 위해 경쟁하고 있습니다.
Google의 Gemma Open 모델, 커뮤니티 변형 상위 100,000개로 다운로드 수 10억 회 돌파
Google은 자사의 Gemma 개방형 모델이 100,000개 이상의 커뮤니티 변형, NASA와의 궤도 배포 및 새로운 Awesome Gemma 허브를 통해 10억 건의 다운로드를 돌파했다고 밝혔습니다.
Ornith-1.5는 완전 개방형, 자체 개선 모델을 사용하여 Agentic 코딩 벤치마크에서 Claude Opus 4.8과 일치합니다.
MIT 라이선스 Ornith-1.5 제품군은 자체 교육 작업과 비계를 생성하며 397B 주력 제품은 Terminal-Bench 2.1 코딩에서 Claude Opus 4.8과 연결됩니다.
Alibaba의 Qwen 3.8 27B는 노트북에서 실행되며 자체 더 큰 모델을 능가합니다.
Alibaba의 Qwen 3.8 27B는 노트북에서 실행되고 폐쇄형 Qwen 3.7-Plus를 능가하는 Apache-2.0 비전 모델입니다. 그러나 기본 추론 설정은 모든 것을 지나치게 고려합니다.
Alibaba의 Qwen AI 모델, 메타와 Google을 제치고 30억 다운로드 돌파
Alibaba의 Qwen 모델은 Qwen 3.8 오픈 가중치가 출시된 지 몇 주 만에 오픈 소스 AI 채택에서 30억 건의 다운로드를 넘어 Meta와 Google을 추월했습니다.
Z.ai의 GLM-5.3, 코딩 성능을 두 배로 높이고 놀라운 사이버 보안 기술로 등장
Z.ai의 새로운 GLM-5.3은 급격한 코딩 향상과 최첨단 취약성 발견을 통해 개방형 경계선에서 Anthropic 및 OpenAI와의 격차를 좁힙니다.
Google, Gemini 3.7 Flash 출시: 코딩 및 에이전트를 위한 가장 똑똑한 제품을 절반 가격으로 출시
Google의 Gemini 3.7 Flash는 3.6 Flash 이후 3주 만에 주요 코딩 및 에이전트 이점을 제공하며 이전 제품 가격의 절반에 해당하는 출시 가격을 제공합니다.
DeepSeek, V4 Pro 정식 출시, 오픈 소스 하네스 에이전트 출시 및 API 가격 인상
중국 AI 연구실 DeepSeek는 V4 Pro를 미리 보기에서 제외하고 Harness v0.1을 Claude Code의 오픈 소스 경쟁 제품으로 출시했으며 IPO를 앞두고 API 가격을 대폭 인상했습니다.
xAI, Frontier Intelligence Index에서 GPT-5.6 Sol과 일치하는 Grok 4.6 출시
xAI의 Grok 4.6은 인공 분석 지능 지수에서 61점을 획득하여 60% 저렴한 비용으로 뛰어난 에이전트 성능을 갖춘 GPT-5.6 Sol과 동점을 기록했습니다. 이제 Cursor 및 Grok Build에서 사용 가능합니다.
Google DeepMind의 SL2T, Pixel 11 휴대폰에 수화 번역 제공
구글 딥마인드는 픽셀 11 프로 폴드를 시작으로 픽셀 11 라인업에서 수화를 텍스트로 바꾸는 수화 번역 모델인 SL2T를 공개했다.
Nvidia, 최고의 오픈 소스 AI 모델에 도전하기 위해 1조 매개변수 Nemotron 4 구축
Nvidia는 선도적인 개방형 시스템과 경쟁하기 위해 최소 1조 개의 매개변수를 갖춘 오픈 소스 AI 모델인 Nemotron 4를 개발하고 있습니다. 이 모델은 올 가을에 도착할 수 있습니다.
NVIDIA, 보다 스마트한 Agentic AI를 위한 Nemotron 3.5 Lightning 및 NeMo Switchyard 출시
NVIDIA의 새로운 300억 매개변수 개방형 모델과 오픈 소스 라우팅 라이브러리는 엣지 장치, PC 및 클라우드 전반에서 최대 4배 더 빠른 출력과 30% 더 빠른 에이전트 작업을 약속합니다.
Mark Zuckerberg는 메타 오픈소스의 가장 강력한 모델인 초지능 선언문에서 폐쇄된 AI 라이벌과의 전쟁을 선포했습니다.
Meta의 Mark Zuckerberg는 모두를 위한 초지능 AI를 요구하는 포괄적인 선언문을 발표하고 폐쇄적인 AI 경쟁사를 공격하고 Meta의 가장 강력한 모델의 공개 버전을 출시했습니다.
Meta, 소비자 GPU에서 AI 에이전트를 실행하는 30B 개방형 모델인 Muse Glimmer 출시
Meta는 로컬로 실행되는 동안 에이전트 벤치마크에서 Gemma4-31B 및 Qwen3.6-27B보다 뛰어난 Apache 2.0 기반의 300억 매개변수 개방형 모델인 Muse Glimmer를 게시했습니다.
OpenAI, 평가 후 '중요' 사이버 보안 기능 표시 후 Astra 모델 일시 중지
OpenAI는 테스트 결과 가장 높은 위험 단계를 유발하는 첫 번째 모델인 '중요' 사이버 보안 임계값에 도달할 수 있는 것으로 나타난 후 곧 출시될 Astra 모델의 개발을 일시 중지했습니다.
ByteDance는 라이벌 Anthropic의 Mythos에 대해 10조 매개변수 AI 모델을 훈련한 것으로 알려졌습니다.
Financial Times는 ByteDance가 Anthropic의 Mythos 규모에 맞게 설계된 대규모 10조 매개변수 모델을 구축하여 미국-중국 AI 경쟁을 강화하고 있다고 보도했습니다.
OpenAI, 중요한 사이버 보안 문제로 인해 새로운 Astra 모델에 대한 작업을 일시 중지
OpenAI는 내부 테스트에서 중요한 수준의 사이버 기능이 밝혀진 후 곧 출시될 Astra 모델의 개발 속도를 늦추고 출시 전에 통제를 강화했습니다.
xAI의 Imagine Image 2.0은 Arena 벤치마크에서 OpenAI의 GPT-Image-2 바로 뒤에 위치합니다.
xAI는 새로운 편집 도구, 다중 참조 지원 및 사전 구성된 템플릿을 통해 OpenAI의 GPT-Image-2에 이어 Arena 벤치마크에서 세계 2위를 차지한 Grok용 Imagine Image 2.0을 출시했습니다.
OpenAI, '중요한' 사이버 보안 위험 임계값에 도달한 후 Astra 모델 개발 일시 중지
OpenAI는 내부 테스트에서 Astra가 최초의 모델인 대비 프레임워크에서 가장 높은 사이버 보안 위험 수준에 도달할 수 있다는 사실을 발견한 후 Astra 개발의 일부를 중단했습니다.
ByteDance는 라이벌 Anthropic의 Mythos를 위해 10조 매개변수 AI 모델을 훈련하고 있습니다.
ByteDance는 최대 10조 개의 매개변수를 갖춘 메가 AI 모델을 훈련하고 있습니다. 이는 Anthropic의 Mythos 5 추정 크기에 가깝고 중국의 현재 지도자들을 왜소하게 만듭니다.
Mistral의 Shieldstral: 정책을 기억하는 대신 읽는 3B 개방형 안전 모델
Mistral AI는 추론 시 일반 언어 조정 정책에 대해 텍스트와 이미지를 평가하는 3B 매개변수 개방형 가중치 안전 분류기인 Shieldstral을 출시했습니다.
Alibaba, Qwen3.8-Max 출시: Anthropic의 Claude와 경쟁하는 2조 4천억 매개변수 모델
Alibaba는 벤치마크에서 Anthropic의 Claude만을 뒤쫓는 2.4조 매개변수 모델인 Qwen3.8-Max를 출시했으며, 공개 가중치는 며칠 내에 약속되었습니다.
OpenAI의 Astra 모델은 기계 확인 증명을 통해 오랫동안 풀리지 않았던 10가지 수학 문제를 해결합니다.
OpenAI의 미공개 Astra 모델은 Lean 검증 증명을 통해 수학 및 컴퓨터 과학 분야의 10가지 공개 문제를 해결하여 미국 정부 검토를 앞두고 다음 주요 모델을 예고했습니다.
Google이 출시를 앞두고 LM Arena 블라인드 테스트에서 Gemini 3.5 Pro 표면을 선보였습니다.
Google의 지연된 Gemini 3.5 Pro는 LMSYS Chatbot Arena 블라인드 테스트에서 반복적으로 발견되어 마침내 공개 출시가 임박했음을 알립니다.
Thinking Machines, 주력 크기의 4분의 1로 축소된 Inkling-Small: 276B 개방형 모델 출시
Thinking Machines Lab은 1/4 크기의 플래그십과 일치하는 12B 활성을 갖춘 2,760억 매개변수 개방형 중량 모델인 Inkling-Small을 출시했습니다. 이는 개방형 중량 경쟁에 참가하는 미국 제품입니다.
DeepSeek, 중국의 AI 가격 전쟁이 확대됨에 따라 V4-Flash 공개 베타 출시
DeepSeek은 9개 에이전트 벤치마크에서 자체 주력 제품인 V4 Pro를 능가하는 동시에 가격 면에서는 미국 경쟁사보다 저렴한 재교육 모델을 갖춘 공식 V4-Flash 베타 API를 출시했습니다.
OpenAI, 기업이 AI 비용에 민감해짐에 따라 GPT-5.6 모델 가격을 최대 80% 인하
OpenAI는 Luna를 포함한 두 가지 GPT-5.6 모델의 가격을 인하하여 기업이 AI 지출을 면밀히 조사함에 따라 소형 모델 비용을 최대 80% 절감합니다.
DeepSeek의 새로운 V4-Flash 모델은 60% 더 낮은 비용으로 GPT-5.6 Luna와 일치합니다.
DeepSeek은 OpenAI의 GPT-5.6 Luna를 벤치마크에서 거의 묶으면서 가격은 약 60% 더 저렴한 개방형 모델인 V4-Flash '0731'을 출시했습니다.
중국 MiniMax, 2K 클립, 스테레오 사운드 및 오픈 웨이트를 갖춘 H3 AI 비디오 모델 출시
중국 AI 스타트업 MiniMax는 2026년 7월 31일 H3 비디오 생성 모델을 출시하여 경쟁사보다 훨씬 저렴한 가격으로 2K 해상도, 스테레오 오디오 및 개방형 가중치를 제공하며 ByteDance의 Seedance 2.5에 직접 도전했습니다.
Google DeepMind, 전신 휴머노이드 제어 및 다중 로봇 협업 기능을 갖춘 Gemini Robotics 2 공개
Google DeepMind는 휴머노이드 로봇이 몸 전체에서 작업을 이동하고 파악하고 조정할 수 있도록 하는 비전-언어-동작 모델인 Gemini Robotics 2를 출시했습니다.
OpenAI, 기업이 AI 비용을 재고함에 따라 GPT-5.6 API 가격을 최대 80% 인하
OpenAI는 2026년 7월 30일 GPT-5.6 Luna 및 Terra API 가격을 최대 80% 인하하여 기업이 추론 지출을 면밀히 조사함에 따라 Anthropic보다 가격을 낮췄습니다.
OpenAI는 GPT-5.6 Sol이 ARC-AGI-3에서 Claude Opus 5를 능가하지만 자체 설정에서만 가능하다고 말합니다.
OpenAI는 GPT-5.6 Sol이 유지된 추론과 압축을 사용하여 ARC-AGI-3에서 38.3%를 기록하여 Claude Opus 5를 차지했다고 보고합니다. 그러나 공식 하네스는 다른 이야기를 말하며 벤치마크 공정성에 대한 논쟁을 불러일으킵니다.
Black Forest Labs, FLUX 3 공개: 이미지, 비디오, 오디오 및 로봇공학을 위한 단일 AI 모델
Black Forest Labs는 이미지, 기본 오디오가 포함된 비디오 및 로봇 동작 예측을 공동으로 생성하는 다중 모드 모델인 FLUX 3을 출시했습니다. 이는 비교의 77%에서 Runway Gen-4.5보다 선호됩니다.
