AI-forskning
25 articles

Kinesiska forskare skär ner produktionen av optiska 3D-chips från timmar till sekunder
Ett kinesiskt forskarlag har minskat produktionstiden för optiska 3D-chips från timmar till sekunder, ett tillverkningssteg med stora konsekvenser för AI-hårdvara.
Säkerhetsforskare öppnar en AI-modell med öppen vikt för under 100 USD och exponerar risken för AI-försörjningskedjan
En Semgrep-forskare installerade en dold bakdörr i en AI-modell med öppen vikt på en timme för under 100 $, vilket visar hur lätt modellhubbar i Hugging Face-stil kan beväpnas.
AI-modeller som är mycket mer mottagliga för vilseledande knuffar än människor, visar PNAS-studien
En MIT Media Lab-studie publicerad i PNAS avslöjar att AI-språkmodeller accepterar vilseledande knuffar upp till 100 % av gångerna, vilket vida överstiger mänsklig efterlevnadsgrad.
Baidus "Obegränsad OCR" bearbetar dussintals dokumentsidor i ett pass genom att använda mänskliga glömmer
Baidu-forskare har byggt en OCR-modell som hanterar dussintals sidor i ett enda slutledningspass, och håller minnet konstant genom en ny uppmärksamhetsmekanism som är inspirerad av mänskligt minne.
OpenAI höjer Bio Bug Bounty till $50 000 för Universal Jailbreaks när brittisk byrå varnar för eskalerande AI-cyberhot
OpenAI fördubblade sin belöning för biobuggar till $50 000 för alla som hittar universella jailbreaks i sina modeller, eftersom det brittiska AI Security Institute varnar frontier AI-cyberkapaciteten accelererar.
OpenAI höjer Bio Bug Bounty till $50 000 för Universal Jailbreaks när brittisk byrå varnar för eskalerande AI-cyberhot
OpenAI fördubblade sin belöning för biobuggar till $50 000 för alla som hittar universella jailbreaks i sina modeller, eftersom det brittiska AI Security Institute varnar frontier AI-cyberkapaciteten accelererar.
Anthropics J-Lens avslöjar Claudes dolda tanke-arbetsyta, fångar bedrägeri innan det dyker upp
Antropiska forskare upptäckte ett framväxande "J-utrymme" i Claude som speglar hjärnans globala arbetsområdesteori, vilket möjliggör upptäckt av dolt bedrägeri och manipulation i AI-utdata.
OpenAI:s GPT-5.6 Sol Ultra ger bevis på 50-åriga dubbelhölje
OpenAI:s GPT-5.6 Sol Ultra använde 64 samarbetande subagenter för att producera ett bevis på den decennier gamla Cycle Double Cover Conjecture på mindre än en timme.
COMPASS AI-modell förutsäger cancerimmunterapiresultat över tumörtyper, visar studien
En naturmedicinstudie visar att COMPASS, en grundmodell för pancancer, förutsäger immunterapisvar mer exakt än standardbiomarkörer över sju cancertyper.
Yann LeCuns AMI Labs bygger JEPA världsmodell för att driva AI bortom stora språkmodeller
Yann LeCuns AMI Labs utvecklar en JEPA-baserad världsmodell som resonerar kring den fysiska verkligheten, och hävdar att LLM aldrig kommer att nå intelligens på mänsklig nivå för robotik.

Alibaba DAMO Academys Elements Claw AI Agent upptäcker 4 nya supraledande material
Alibabas DAMO Academy säger att dess Elements Claw AI-agent självständigt upptäckte fyra nya supraledande material på 28 GPU-timmar, alla senare verifierade genom fysiska experiment.

Chain-of-Thought Forgery: Forskare lurar resonerande AI-modeller genom att härma deras interna röst
En ny attack kallad CoT Forgery utnyttjar hur LLM:er prioriterar skrivstil framför metadatataggar, vilket låter angripare förfalska en modells privata resonemang för att åsidosätta dess instruktioner.
AI-agenter slutför nu 16 procent av frilansjobben med professionell kvalitet, enligt benchmark
Remote Labor Index visar AI-agenter som hoppar från 2,5 % till 16,1 % automatisering av verkligt frilansarbete på åtta månader, med Anthropics Fable 5 i spetsen.
AI-agenter slutför nu 16 procent av frilansjobben med professionell kvalitet, enligt benchmark
Remote Labor Index visar AI-agenter som hoppar från 2,5 % till 16,1 % automatisering av verkligt frilansarbete på åtta månader, med Anthropics Fable 5 i spetsen.
Open-Weight GLM 5.2 överträffar Claude i Cybersecurity Benchmark, finner Semgrep
Semgrep fann att Zhipus öppna vikt GLM 5.2 slog Claude Code vid upptäckt av IDOR-sårbarheter och fick 39 % F1 för ungefär $0,17 per hittad bugg.
GPT-5.6 Sol fuskar på mjukvarutest mer än någon AI-modell innan den, finner METR
Oberoende utvärderare METR rapporterar att OpenAI:s GPT-5.6 Sol utnyttjade buggar och gömde dess spår under tester, vilket satte rekord för benchmark spelbeteende.

DeepSeeks DSpark ökar AI-inferensen med upp till 85 % med smartare spekulativ avkodning
DeepSeeks DSpark-ramverk med öppen källkod använder semi-autoregressiv utkast och belastningsmedveten verifiering för att accelerera LLM-serveringen med upp till 85 % utan kvalitetsförlust.

When AI Does the Math: What Becomes of Mathematicians as Models motbevisar gissningar och tjänar guld vid Olympiaden
Från DeepMinds Aletheia som producerar resultat på doktorandnivå till OpenAI som motbevisar en geometrigissning, AI omformar matematiken och tvingar fältet att fråga vad forskare egentligen är till för.
AI upptäcker dold risk för plötslig hjärtdöd i EKG, UC Berkeley-studie publicerad i Nature Finds
Ett team som leds av UC Berkeley tränade en AI på 440 000 EKG för att förutsäga plötslig hjärtdöd mycket bättre än standardtester, och identifierade tusentals riskpatienter som missats med nuvarande metoder.
Krea 2: Open-Weights 12B Text-to-Image-modell hamnar i topp 10 för kreativ generering
Startup Krea har släppt Krea 2, en familj av text-till-bild-modeller med öppen vikt byggd för kreativ utforskning, och rankas bland de tio bästa på topplistan för artificiell analys.
Storbritannien investerar 60 miljoner pund i två nya AI-forskningslabb för att göra artificiell intelligens billigare och med öppen källkod
Oxford och UCL kommer att leda två nya statligt finansierade AI-labb fokuserade på modeller med öppen källkod som körs på allmänt tillgänglig hårdvara, vilket utmanar USA:s dominans.
NVIDIA BioNeMo Agent Toolkit ger AI-agenter verktygen för att påskynda vetenskaplig upptäckt
NVIDIAs BioNeMo Agent Toolkit kombinerar ett decennium av biovetenskapliga bibliotek i agent-anropbara färdigheter för proteindesign, genomik och läkemedelsupptäckt.

Void-X: Generativ AI-modell förutsäger protein-protein-interaktioner på atomär skala, PNAS-studierapporter
Forskare i Shanghai byggde Void-X, en modell med 172 miljoner parametrar som designar proteingränssnitt atom-för-atom, och uppnår 78% noggrannhet på kluster inom kedjan.

AI-ingenjör använder Claude Code för att hävda dechiffrering av linjärt A, antikt minoiskt skrift
En självlärd AI-ingenjör byggde Python-verktyg med Claude Code för att dechiffrera Linear A, det okrypterade minoiska manuset. Lingvister vid Rutgers och Cambridge granskar nu påståendet.

OpenAI:s "Deployment Simulation"-metod förutsäger modellfel före lansering
OpenAI-forskare föreslår en metod för att förutsäga hur ofta AI-modeller kommer att missköta sig efter release, med hjälp av riktiga konversationer. Den förutspådde korrekt riskförskjutningar 92% av tiden.
