AI-forskning

25 articles

Kinesiska forskare skär ner produktionen av optiska 3D-chips från timmar till sekunder
AI-forskning

Kinesiska forskare skär ner produktionen av optiska 3D-chips från timmar till sekunder

Ett kinesiskt forskarlag har minskat produktionstiden för optiska 3D-chips från timmar till sekunder, ett tillverkningssteg med stora konsekvenser för AI-hårdvara.

19 juli 20264 min read
Säkerhetsforskare öppnar en AI-modell med öppen vikt för under 100 USD och exponerar risken för AI-försörjningskedjan
AI-forskning

Säkerhetsforskare öppnar en AI-modell med öppen vikt för under 100 USD och exponerar risken för AI-försörjningskedjan

En Semgrep-forskare installerade en dold bakdörr i en AI-modell med öppen vikt på en timme för under 100 $, vilket visar hur lätt modellhubbar i Hugging Face-stil kan beväpnas.

17 juli 20265 min read
AI-modeller som är mycket mer mottagliga för vilseledande knuffar än människor, visar PNAS-studien
AI-forskning

AI-modeller som är mycket mer mottagliga för vilseledande knuffar än människor, visar PNAS-studien

En MIT Media Lab-studie publicerad i PNAS avslöjar att AI-språkmodeller accepterar vilseledande knuffar upp till 100 % av gångerna, vilket vida överstiger mänsklig efterlevnadsgrad.

13 juli 20265 min read
Baidus "Obegränsad OCR" bearbetar dussintals dokumentsidor i ett pass genom att använda mänskliga glömmer
AI-forskning

Baidus "Obegränsad OCR" bearbetar dussintals dokumentsidor i ett pass genom att använda mänskliga glömmer

Baidu-forskare har byggt en OCR-modell som hanterar dussintals sidor i ett enda slutledningspass, och håller minnet konstant genom en ny uppmärksamhetsmekanism som är inspirerad av mänskligt minne.

12 juli 20265 min read
OpenAI höjer Bio Bug Bounty till $50 000 för Universal Jailbreaks när brittisk byrå varnar för eskalerande AI-cyberhot
AI-forskning

OpenAI höjer Bio Bug Bounty till $50 000 för Universal Jailbreaks när brittisk byrå varnar för eskalerande AI-cyberhot

OpenAI fördubblade sin belöning för biobuggar till $50 000 för alla som hittar universella jailbreaks i sina modeller, eftersom det brittiska AI Security Institute varnar frontier AI-cyberkapaciteten accelererar.

11 juli 20264 min read
OpenAI höjer Bio Bug Bounty till $50 000 för Universal Jailbreaks när brittisk byrå varnar för eskalerande AI-cyberhot
AI-forskning

OpenAI höjer Bio Bug Bounty till $50 000 för Universal Jailbreaks när brittisk byrå varnar för eskalerande AI-cyberhot

OpenAI fördubblade sin belöning för biobuggar till $50 000 för alla som hittar universella jailbreaks i sina modeller, eftersom det brittiska AI Security Institute varnar frontier AI-cyberkapaciteten accelererar.

11 juli 20264 min read
Anthropics J-Lens avslöjar Claudes dolda tanke-arbetsyta, fångar bedrägeri innan det dyker upp
AI-forskning

Anthropics J-Lens avslöjar Claudes dolda tanke-arbetsyta, fångar bedrägeri innan det dyker upp

Antropiska forskare upptäckte ett framväxande "J-utrymme" i Claude som speglar hjärnans globala arbetsområdesteori, vilket möjliggör upptäckt av dolt bedrägeri och manipulation i AI-utdata.

11 juli 20264 min read
OpenAI:s GPT-5.6 Sol Ultra ger bevis på 50-åriga dubbelhölje
AI-forskning

OpenAI:s GPT-5.6 Sol Ultra ger bevis på 50-åriga dubbelhölje

OpenAI:s GPT-5.6 Sol Ultra använde 64 samarbetande subagenter för att producera ett bevis på den decennier gamla Cycle Double Cover Conjecture på mindre än en timme.

11 juli 20265 min read
COMPASS AI-modell förutsäger cancerimmunterapiresultat över tumörtyper, visar studien
AI-forskning

COMPASS AI-modell förutsäger cancerimmunterapiresultat över tumörtyper, visar studien

En naturmedicinstudie visar att COMPASS, en grundmodell för pancancer, förutsäger immunterapisvar mer exakt än standardbiomarkörer över sju cancertyper.

4 juli 20265 min read
Yann LeCuns AMI Labs bygger JEPA världsmodell för att driva AI bortom stora språkmodeller
AI-forskning

Yann LeCuns AMI Labs bygger JEPA världsmodell för att driva AI bortom stora språkmodeller

Yann LeCuns AMI Labs utvecklar en JEPA-baserad världsmodell som resonerar kring den fysiska verkligheten, och hävdar att LLM aldrig kommer att nå intelligens på mänsklig nivå för robotik.

4 juli 20265 min read
Alibaba DAMO Academys Elements Claw AI Agent upptäcker 4 nya supraledande material
AI-forskning

Alibaba DAMO Academys Elements Claw AI Agent upptäcker 4 nya supraledande material

Alibabas DAMO Academy säger att dess Elements Claw AI-agent självständigt upptäckte fyra nya supraledande material på 28 GPU-timmar, alla senare verifierade genom fysiska experiment.

4 juli 20264 min read
Chain-of-Thought Forgery: Forskare lurar resonerande AI-modeller genom att härma deras interna röst
AI-forskning

Chain-of-Thought Forgery: Forskare lurar resonerande AI-modeller genom att härma deras interna röst

En ny attack kallad CoT Forgery utnyttjar hur LLM:er prioriterar skrivstil framför metadatataggar, vilket låter angripare förfalska en modells privata resonemang för att åsidosätta dess instruktioner.

3 juli 20265 min read
AI-agenter slutför nu 16 procent av frilansjobben med professionell kvalitet, enligt benchmark
AI-forskning

AI-agenter slutför nu 16 procent av frilansjobben med professionell kvalitet, enligt benchmark

Remote Labor Index visar AI-agenter som hoppar från 2,5 % till 16,1 % automatisering av verkligt frilansarbete på åtta månader, med Anthropics Fable 5 i spetsen.

2 juli 20265 min read
AI-agenter slutför nu 16 procent av frilansjobben med professionell kvalitet, enligt benchmark
AI-forskning

AI-agenter slutför nu 16 procent av frilansjobben med professionell kvalitet, enligt benchmark

Remote Labor Index visar AI-agenter som hoppar från 2,5 % till 16,1 % automatisering av verkligt frilansarbete på åtta månader, med Anthropics Fable 5 i spetsen.

2 juli 20265 min read
Open-Weight GLM 5.2 överträffar Claude i Cybersecurity Benchmark, finner Semgrep
AI-forskning

Open-Weight GLM 5.2 överträffar Claude i Cybersecurity Benchmark, finner Semgrep

Semgrep fann att Zhipus öppna vikt GLM 5.2 slog Claude Code vid upptäckt av IDOR-sårbarheter och fick 39 % F1 för ungefär $0,17 per hittad bugg.

29 juni 20265 min read
GPT-5.6 Sol fuskar på mjukvarutest mer än någon AI-modell innan den, finner METR
AI-forskning

GPT-5.6 Sol fuskar på mjukvarutest mer än någon AI-modell innan den, finner METR

Oberoende utvärderare METR rapporterar att OpenAI:s GPT-5.6 Sol utnyttjade buggar och gömde dess spår under tester, vilket satte rekord för benchmark spelbeteende.

28 juni 20264 min read
DeepSeeks DSpark ökar AI-inferensen med upp till 85 % med smartare spekulativ avkodning
AI-forskning

DeepSeeks DSpark ökar AI-inferensen med upp till 85 % med smartare spekulativ avkodning

DeepSeeks DSpark-ramverk med öppen källkod använder semi-autoregressiv utkast och belastningsmedveten verifiering för att accelerera LLM-serveringen med upp till 85 % utan kvalitetsförlust.

27 juni 20266 min read
When AI Does the Math: What Becomes of Mathematicians as Models motbevisar gissningar och tjänar guld vid Olympiaden
AI-forskning

When AI Does the Math: What Becomes of Mathematicians as Models motbevisar gissningar och tjänar guld vid Olympiaden

Från DeepMinds Aletheia som producerar resultat på doktorandnivå till OpenAI som motbevisar en geometrigissning, AI omformar matematiken och tvingar fältet att fråga vad forskare egentligen är till för.

27 juni 20266 min read
AI upptäcker dold risk för plötslig hjärtdöd i EKG, UC Berkeley-studie publicerad i Nature Finds
AI-forskning

AI upptäcker dold risk för plötslig hjärtdöd i EKG, UC Berkeley-studie publicerad i Nature Finds

Ett team som leds av UC Berkeley tränade en AI på 440 000 EKG för att förutsäga plötslig hjärtdöd mycket bättre än standardtester, och identifierade tusentals riskpatienter som missats med nuvarande metoder.

25 juni 20265 min read
Krea 2: Open-Weights 12B Text-to-Image-modell hamnar i topp 10 för kreativ generering
AI-forskning

Krea 2: Open-Weights 12B Text-to-Image-modell hamnar i topp 10 för kreativ generering

Startup Krea har släppt Krea 2, en familj av text-till-bild-modeller med öppen vikt byggd för kreativ utforskning, och rankas bland de tio bästa på topplistan för artificiell analys.

24 juni 20265 min read
Storbritannien investerar 60 miljoner pund i två nya AI-forskningslabb för att göra artificiell intelligens billigare och med öppen källkod
AI-forskning

Storbritannien investerar 60 miljoner pund i två nya AI-forskningslabb för att göra artificiell intelligens billigare och med öppen källkod

Oxford och UCL kommer att leda två nya statligt finansierade AI-labb fokuserade på modeller med öppen källkod som körs på allmänt tillgänglig hårdvara, vilket utmanar USA:s dominans.

24 juni 20265 min read
NVIDIA BioNeMo Agent Toolkit ger AI-agenter verktygen för att påskynda vetenskaplig upptäckt
AI-forskning

NVIDIA BioNeMo Agent Toolkit ger AI-agenter verktygen för att påskynda vetenskaplig upptäckt

NVIDIAs BioNeMo Agent Toolkit kombinerar ett decennium av biovetenskapliga bibliotek i agent-anropbara färdigheter för proteindesign, genomik och läkemedelsupptäckt.

23 juni 20264 min read
Void-X: Generativ AI-modell förutsäger protein-protein-interaktioner på atomär skala, PNAS-studierapporter
AI-forskning

Void-X: Generativ AI-modell förutsäger protein-protein-interaktioner på atomär skala, PNAS-studierapporter

Forskare i Shanghai byggde Void-X, en modell med 172 miljoner parametrar som designar proteingränssnitt atom-för-atom, och uppnår 78% noggrannhet på kluster inom kedjan.

20 juni 20265 min read
AI-ingenjör använder Claude Code för att hävda dechiffrering av linjärt A, antikt minoiskt skrift
AI-forskning

AI-ingenjör använder Claude Code för att hävda dechiffrering av linjärt A, antikt minoiskt skrift

En självlärd AI-ingenjör byggde Python-verktyg med Claude Code för att dechiffrera Linear A, det okrypterade minoiska manuset. Lingvister vid Rutgers och Cambridge granskar nu påståendet.

20 juni 20266 min read
OpenAI:s "Deployment Simulation"-metod förutsäger modellfel före lansering
AI-forskning

OpenAI:s "Deployment Simulation"-metod förutsäger modellfel före lansering

OpenAI-forskare föreslår en metod för att förutsäga hur ofta AI-modeller kommer att missköta sig efter release, med hjälp av riktiga konversationer. Den förutspådde korrekt riskförskjutningar 92% av tiden.

20 juni 20266 min read