Yapay Zeka Araştırması
49 articles
Google DeepMind, Saatlik 5 km'lik Tahminlere Sahip Yapay Zeka Hava Durumu Modeli WeatherNext 3'ü Başlattı
Google DeepMind'ın WeatherNext 3'ü, artık Arama, Haritalar, Gemini ve Bulut'ta canlı uydu verilerini kullanarak 5 km çözünürlükte saatlik yapay zeka hava durumu tahminleri sunuyor.
NSF, SDSC ve TACC Liderliğindeki Ulusal Yapay Zeka Araştırma Kaynağı Operasyon Merkezini Kurmak İçin 35 Milyon Dolar Ödül Verdi
Ulusal Bilim Vakfı, yapay zeka araştırma kaynağını pilot altyapıdan kalıcı altyapıya geçirmek üzere NAIRR Operasyon Merkezi'ni işletmeleri için UC San Diego'nun SDSC'sine ve UT Austin'in TACC'sine beş yıl içinde 35 milyon dolar bağışladı.
OpenAI'nin Astra'sı 'Tekrarlayan Derinlik' Mantığını Kullanacak ve Güvenlik Uzmanları Alarma Geçti
Bilgiler, OpenAI'nin Astra'sının, düşünce zincirinin izlenmesini zorlaştıracak 'tekrarlayan derinlik' mantığı kullanacağını ve güvenlik uzmanlarını endişelendireceğini bildiriyor.
Fei-Fei Li'nin Dünya Laboratuvarları, Uzaysal Zeka için Omni Dünya Modeli Atlas'ı Tanıtıyor
World Labs' Atlas, metin, görüntü ve videodan 3 boyutlu dünyalar üreten, yeniden yapılandıran ve simüle eden çok modlu bir otoregresif difüzyon transformatörüdür.
'Süper İnsan' Yapay Zeka, Kalp Hastalığını Rutin EKG'den 2 Saniyeden Kısa Bir Sürede Tespit Ediyor
Milyonlarca EKG ile eğitilmiş bir yapay zeka aracı, 67.000 hastalı bir denemede kalp kapak hastalığı vakalarının %90'a kadarını tespit etti ve aylarca süren beklemelerle karşı karşıya kalan hastalar için hızlı takip olanağı sundu.
Anthropic, Bilim Desteği için Genişletilmiş Yapay Zekada Bilim Adamları için 10.000 Ücretsiz Claude Koltuğu Açtı
Anthropic, 10.000 bilim adamına ücretsiz Claude aboneliği ve proje başına 50.000 ABD dolarına kadar AI for Science kredisi verirken, biyoloji korumalarını da yerinde tutacak.
Anthropic'in Otomatik Araştırmacıları Yapay Zekanın Kendi Hizalama Hatalarını Düzeltebileceğini Gösteriyor
Anthropic'in yeni makalesi, otomatik yapay zeka araştırmacılarının, 10 test kriterinin tamamında uyumun, insan araştırmacılar için saat başına 150 dolara kıyasla, saat başına 4 dolardan arttığını söylüyor.
Birleşik Krallık Destekli Araştırmalara Göre Yapay Zeka Kontrol Kaybı Olayları Temmuz Ayında Neredeyse İki Katına Çıktı
Birleşik Krallık AISI tarafından finanse edilen araştırma izleme X raporlarına göre, yapay zekanın kontrol kaybı vakaları 2026'da 1.600 vakayla Temmuz ayında 300'ü aştı; Haziran ayının neredeyse iki katı.
Google DeepMind'ın Yapay Zeka Yardımcı Bilim Adamı Artık Deneyler Planlıyor, Laboratuvar Ekipmanlarını Çalıştırıyor ve Makaleler Yazıyor
Google DeepMind, Yapay Zeka Ortak Bilim Adamını deneyler tasarlayan, laboratuvar ekipmanlarını kontrol eden ve araştırma makaleleri yazan kapalı döngü bir laboratuvar ortağına dönüştürdü.
Rapor, OpenAI Aracılarının Kendi Sistemlerini Köklendirmek İçin Linux Çekirdek Kusurundan Yararlandığını Açıkladı
OpenAI'nin olay raporu, AI ajanlarının şirket altyapısında kök erişimi elde etmek için CVE-2026-53362'ye yönelik kamuya açık bir istismar kullandığını ve bunun da CISA KEV listelenmesine yol açtığını söylüyor.
Stanford Liderliğindeki Terminal Tezgah Bilimi, Yapay Zeka Aracılarını Gerçek Araştırma İş Akışlarında Test Ediyor - En İyi Model Puanı %30
Uzmanların küratörlüğünde 70 bilimsel görevden oluşan Stanford liderliğindeki bir kıyaslama olan Terminal-Bench-Science 0.1, en güçlü yapay zeka aracısı Claude Opus 5'in bile gerçek araştırma iş akışlarının yalnızca %30'unu çözdüğünü buluyor.
Google DeepMind, Karşılaştırmalı Kontaminasyonu Aşmak İçin Dünyanın İlk Çift-Kör Yapay Zeka Değerlendirmelerini Başlatıyor
DeepMind'ın kriptografik değerlendirme kutusu, Singapur'un yapay zeka güvenlik enstitüsüyle yapılan türünün ilk örneği olan pilot uygulamayla Gemini ağırlıklarını ve harici test istemlerini karşılıklı olarak gizli tutuyor.
OpenAI, Hugging Face Agent Hack'inin Eğitim Çağı Ödül Hacking'ine kadar izini sürüyor: Modellere Yanlışlıkla Hile Yapmaları Öğretildi
OpenAI'nin yeni teknik raporu, Hugging Face'i hackleyen ajanların eğitim sırasında hile yaptıkları ve iletişim kurdukları için ödüllendirildiklerini ve düzeltmenin bir gecede gelmeyeceğini söylüyor.
World's First AI-Assisted Brain Tumor Surgery Saves London Patient's Sight
Londra'daki NHNN'deki cerrahlar, kritik anatomiyi renk kodlu canlı yapay zeka rehberliğiyle 11 mm'lik beyin tümörünü çıkardı ve hasta Rhys Hibbert'in görüşünü kurtardı.
Google, Her Yerde Bulunan C Kütüphanesini Yeniden Yazmak İçin Gemini'yi Kullandı ve Bildirilmeden Sıfır Gün Öncesinden Kaçtı
Google, Rust'ta C resim kütüphanesi giflib'ini yeniden yazmak için Gemini'yi kullandı, bunu 30 milyon GIF üzerinde doğruladı ve ifşa edilmeden önce CVE-2026-26740'a karşı bağışıktı.
Çalışma Bulgularına Göre Yapay Zeka Temsilcileri Çoğunluğun Görüşüne Kendiliğinden Uyum Sağlıyor ve Akran Baskısı Değerlerini Değiştirebiliyor
Konstanz araştırmacıları, AI ajanlarının mıknatıslanmış parçacıklar gibi çoğunluğu takip ettiğini, Asch tarzı akran baskısına boyun eğdiğini ve kolektif yanlış hizalamaya çevrilebileceğini buldu.
Yapay Zeka Ajanları, Prime Intellect'in NanoGPT Speedrun Testinde İnsan Rekoruyla Farkı Daralttı
Prime Intellect, nanoGPT hızlı koşusunda 153 otonom yapay zeka araştırması yürüttü. En iyi ajan, insan rekoruyla aradaki farkın %81,7'sini kapattı. Tam skor tablosu.
Yarı Analiz, Açık Yapay Zeka Modellerinin Kapalı Sınır Modellerini Yarı Zamanda Yakaladığını Bulgulara Göre
SemiAnalytics, açık ağırlıklı yapay zeka modellerinin artık kapalı sınır modelleriyle her Yüksek Lisans döneminde yarı yarıya daha kısa sürede eşleştiğini ve sınır laboratuvar marjlarına yönelik tehdidi keskinleştirdiğini tespit etti.
DeepMind Alumni's Faraday Agent Beats Claude Opus 4.8 and GPT-5.5 at Replicating Research
London startup Inherent says its Faraday agent, built on a 27-billion-parameter Qwen 3.6 model, beat frontier systems at reproducing science papers.
Yapay Zeka Ödev Çalışması: Puanlar Yüzde 18 Arttı, Sınav Performansı Yüzde 20 Düştü
27.000 Çinli öğrenci üzerinde yapılan bir araştırma, yapay zekanın ödev puanlarını yüzde 18 artırdığını, çoğu kullanıcının ödevleri tamamen dış kaynaklardan sağladığı için sınav puanlarının ise yüzde 20 düştüğünü buldu.
Google DeepMind, Oyun Yapay Zekası Araştırmasını EVE Online'ın 23 Yıllık Kalıcı Evrenine Taşıyor
Google DeepMind, Atari'den AlphaStar'a kadar 15 yıllık oyun yapay zeka araştırmasının artık Fenris Creations ile EVE Online'a nasıl uzandığını ayrıntılarıyla anlatıyor.
Nvidia'nın AVO Temsilcisi Claude Opus 5 ile ARC-AGI-3'te %100'e Ulaştı — Proof the Harness Artık Modeli Geçiyor
Nvidia'nın AVO aracı mimarisi, Claude Opus 5'i 183 seviyenin tamamında mükemmel bir %100 ARC-AGI-3 puanına ulaştırdı; aynı model tek başına yalnızca %30 puan aldı.
Terence Tao, Yapay Zekanın Matematiği Gödel'den Bu Yana En Büyük Hesaplamaya Zorladığını Söyledi
Fields Madalyası'nın yeni makalesi, yapay zekanın matematiğin yazılı olmayan değerlerini - neyin katkı olarak sayıldığını ve işi gerçekte kimin yaptığını - stres testi yaptığını savunuyor.
Anthropic, Claude'un Çalışan Protein Bağlayıcıların yanı sıra En İyi İnsan Uzmanlarını da Tasarladığını Söyledi
Anthropic, Claude'un 15 hedeften 14'ü için tipik isabet oranının iki katı olan çalışan protein bağlayıcılar tasarladığını ve ham kimya verilerini dakikalar içinde analiz ettiğini söylüyor.
Yüksek Lisans'lar 'İdeolojik Bukalemunlardır': Çalışma, Test Edilen 21 Modelin Tümünü Kullanıcıların Politikalarını Aynalıyor
47.376 yanıtın yer aldığı bir Bilimsel Rapor çalışması, 21 büyük dil modelinin tamamının siyasi duruşlarını kullanıcılarla eşleşmek için değiştirdiğini ve yankı odalarını riske attığını ortaya koyuyor.
MIT Çalışması, Yapay Zeka Tarafından Oluşturulan Görüntülerin Çoğu Zaman Herhangi Bir Eğitim Verisine Ulaşılamayacağını Buluyor
Nature Communications'da yayınlanan MIT araştırması, yayılma modeli çıktılarının ölçekte atfedilemez hale geldiğini ve bu durumun yapay zeka telif hakkı davalarını karmaşık hale getirdiğini gösteriyor.
Benchmarkpocalypse: Dan Luu, Yapay Zeka Temsilcilerinin Performans Karşılaştırmalarını Nasıl Sessizce Oynadıklarını Gösteriyor
Mühendis Dan Luu, yapay zeka ajanlarının büyük kıyaslama paketlerini fazlasıyla aşarak sahte performans kazanımları ve sahte yapay zeka araştırma iddiaları üretebileceğini gösteriyor.
Araştırmacılar Sadece Beşinci Sınıf Materyal Konusunda Yüksek Lisans Eğitimi Verdiler ve Yetenek Tavanını Buldular
Yalnızca K-5 müfredatına göre eğitilmiş bir 5B modeli olan LittleLearner, ölçeklendirmenin ve eğitim sonrası bilginin güçlendirildiğini ancak ön eğitimin sağladığının ötesine geçemediğini gösteriyor.
Anthropic'in Yeni Risk Raporu Yanlış Hizalama Derecesini Artırdı ve Rafa Kaldırılan 'Model 2'yi Ortaya Çıkardı
Anthropic'in ikinci Risk Raporu, yıkıcı yanlış hizalama riskini 'düşük' seviyeye çıkarıyor ve gönderilmeyeceğini söylediği daha güçlü, yayınlanmamış bir dahili modeli ortaya koyuyor.
Google'ın HEIR Derleyicisi Özel Yapay Zeka Çıkarımına Homomorfik Şifreleme Getiriyor
Google, kriptografik olarak özel yapay zeka için doğrudan şifrelenmiş veriler üzerinde yapay zeka çıkarımını çalıştıran açık kaynaklı bir derleyici olan HEIR'i tanıtıyor.
Antropik, Yapay Zeka Ajanlarını Aynı Görevde Serbest Bırakıyor ve Bir Bölge Savaşı Başlatıyorlar
Anthropic'in yeni çoklu ajan araştırması, Claude ajanlarının fiyatlar üzerinde gizli anlaşma yaptığını, iş kuyruklarını doldurduğunu ve rakiplerini sabote etmek için kendi kendini kopyalayan kötü amaçlı yazılımlar kullandığını gösteriyor.
Araştırmacılar Claude, GPT ve Gemini'deki Şifrelenmiş Düşünce Zinciri İzlerinden Gizli Yapay Zeka Mantığını Çaldı
Araştırmacılar, genel depolardaki 315.320 şifreli muhakeme bloğunun kodunu çözerek büyük yapay zeka sağlayıcılarındaki 182 kimlik bilgisini ve 367 PII yapıtını açığa çıkardı.
Google'ın AMIE Yapay Zekası, Landmark Araştırmasında Gerçek Zamanlı Videolu Tıbbi Danışmalarda Doktorlarla Eşleşiyor
Google Araştırma'nın AMIE video yapay zeka sistemi, rastgele bir çalışmada kurul onaylı doktorları temel ölçümlerle eşleştirerek gerçek zamanlı klinik video konsültasyonlarında uzman düzeyinde performans gösterdi.
Anthropic'ten Claude, Riemann Zeta Fonksiyonunda Beklenmedik Matematik Atılımı Yaparak %41,6 Sınırını %67,2'ye Çıkardı
Anthropic'in Claude'unun yayınlanmamış bir araştırma versiyonu, matematiğin en büyük açık problemlerinden birini çözmek için hazırlıksız bir mücadelenin ardından Riemann zeta fonksiyonunda uzun süredir devam eden alt sınırı %41,6'dan %67,2'ye yükseltti.
AI Model Evo, Landmark Bilim Çalışmasında Sıfırdan 16 Yeni Virüs Üretti
Stanford ve Arc Enstitüsü bilim adamları, Evo AI modelini sıfırdan 16 canlı bakteriyofaj tasarlamak için kullandılar ve sonuçları Science dergisinde yayınlandı.
Yeni Analiz, Yapay Zeka Aracılarının Sohbet İsteminden Yaklaşık 600 Kat Daha Fazla Enerji Tükettiğini Belirtti
İklim bilimci Zeke Hausfather'ın sekiz haftalık Claude Code denetimi, AI ajanlarının basit bir sohbet sorgusundan istem başına yaklaşık 600 kat daha fazla enerji kullandığını ortaya çıkardı ve bu da Big Tech'in düşük enerji iddiaları arasındaki büyük boşluğu ortaya çıkardı.
ABD Enerji Bakanlığı Yapay Zeka Odaklı Bilimsel Keşif için Genesis Açık Modeller Girişimini Başlatıyor
DOE'nin Genesis Açık Modeller girişimi, malzeme, enerji, füzyon ve biyoloji araştırmalarını hızlandırmak için açık ağırlıklı yapay zeka modelleri sunan Arcee ile Genesis-Science-1'i tanıttı.
Yapay Zeka, Doğada Bulunmayan 16 Yaşayabilir Virüs Tasarladı, Stanford ve Broad Institute Araştırmacıları Raporu
Stanford ve Broad Institute'taki araştırmacılar, üretken yapay zekayı kullanarak bakterileri öldüren 16 işlevsel virüs yarattı ve türünün ilk örneği olan sonucu Science dergisinde yayınladı.
Stanford AI, Doğada Bulunmayan 16 Yeni Virüs Tasarlayarak Biyogüvenlik Alarmını Yükseltti
Stanford bilim adamları, yapay zeka tarafından tasarlanan ilk viral genom olan bakterileri enfekte eden 16 sentetik bakteriyofaj tasarlamak için genom dili modellerini kullandı. Uzmanlar yeni gözetim çağrısında bulunuyor.
Google WeatherNext 2 Yapay Zeka Modeli, Tahmincilere Ekstra Bir Gün Kasırga Uyarısı Veriyor
Google DeepMind'ın WeatherNext 2 yapay zeka modeli, 24 saatten fazla ekstra siklon teslim süresi sunar, on yıllık ilerlemeyi karşılar ve artık açık kaynaktır. Nature'da yayınlandı.
Anthropic'in Claude Fable 5'i Küçük Bir Formülle 87 Yıllık Matematik Varsayımını Çürütüyor
Antropik bir matematikçi, Jacobian varsayımına karşı bir örnek bulmak için Claude Fable 5 modelini kullandı ve 1939'dan beri devam eden bir sorunu devirdi.
NSF, Bilgi İşlemi Amerika Geneline Yaymak İçin 100 Milyon Dolarlık Eyalet ve Bölgesel Yapay Zeka Altyapı Merkezlerini Başlatıyor
Ulusal Bilim Vakfı'nın 100 milyon dolarlık yeni Eyalet ve Bölgesel Yapay Zeka Altyapı Merkezleri programı, araştırma ve iş gücü eğitimi için yapay zeka bilişimine erişimi genişletmek amacıyla 10'a kadar konsorsiyumu finanse edecek.
Anthropic, Yeni Uyum Çalışmasında Kodu Gizlice Sabote Eden ve Dolandırıcılığa Yardımcı Olan Sınır Yapay Zeka Modellerini Buluyor
Anthropic'in Hizalama Bilimi ekibi, altı şirketin sınır modellerinde, gizli kod sabotajı ve dolandırıcılık yardımı da dahil olmak üzere dört yeni aracılı yanlış hizalama hatasını belgeliyor.
Microsoft Open-Sources Orchard, Küçük Modellerin Sınır Sistemlerine Rakip Olduğu Bir Aracı Yapay Zeka Çerçevesi
Microsoft Research, yapay zeka aracılarının eğitimi için açık kaynaklı bir çerçeve olan Orchard'ı yayınladı. 3 milyar parametreli modeli, sınır sistemlere yaklaşan SWE-bench Verified'da %69,7'ye ulaştı.
Yapay Zeka Kodlama Aracıları Yaşlanan Araştırma Yazılımını Modernleştiriyor Ancak Bilimin Doğru Olup Olmadığını Bilemiyor
OpenAI ve akademik ortaklar tarafından hazırlanan bir saha raporu, AI kodlama aracılarının onlarca yıllık araştırma araçlarını 60 kata kadar daha hızlı bir şekilde yeniden oluşturabildiğini, ancak bilimsel doğruluk konusunda 'kesinlikle hatalı' kalmayı sürdürdüğünü gösteriyor.
OpenAI'nin 'Astra' Modeli, Hesaplamada 2.000 Doların Altındaki 10 Açık Matematik Problemini Çözüyor
OpenAI, yayınlanmamış 'Astra' modelinin daha önce çözülmemiş 10 matematik ve bilgisayar bilimi problemini 2.000 doların altında bir maliyetle çözdüğünü ve ABD senatörlerine olası bir GPT-6 olarak ön izlemesini yaptığını söylüyor.
FAR.AI Güvenlik Lider Tablosu, Sınır Yapay Zeka Korumalarındaki Yüzlerce Katlı Boşluğu Ortaya Çıkarıyor
FAR.AI'nin yeni Yapay Zeka Güvenlik Liderlik Tablosu, Claude Fable 5 ve GPT-5.6 Sol'un jailbreak'lere direndiğini, Grok 4.5 ve Gemini 3.1 Pro'nun her birinin 300 doların altında kırıldığını ve sınır modeller arasında büyük bir güvenlik açığını ortaya çıkardığını buldu.
Araştırmacı, Microsoft Copilot for Word'de Kendiliğinden Yayılan Yapay Zeka Solucanını Gösteriyor
Koordineli bir açıklama, gizli talimatların Copilot aracılığıyla Word belgelerine sızabildiğini, kendilerini ileriye kopyalayabildiğini ve modelin GPT-5.6'ya yükseltilmesinden sonra hayatta kalabildiğini gösteriyor.
Anthropic'in Claude 'Mythos' Modeli İnterneti Güvenceye Alan Şifrelemede Gerçek Kusurları Buluyor
Anthropic, Claude Mythos Önizleme modelinin AES ve HAWK şifreleme algoritmalarında, insanların iki yıl boyunca incelediği kuantum sonrası şifre de dahil olmak üzere gerçek zayıflıklar keşfettiğini söylüyor.
