Cercetare AI
25 articles

Cercetătorii chinezi reduc producția de cipuri optice 3D de la ore la secunde
O echipă de cercetare chineză a redus timpul de producție a cipurilor optice 3D de la ore la secunde, un salt de producție cu implicații majore pentru hardware-ul AI.
Un cercetător în domeniul securității promovează un model AI deschis pentru mai puțin de 100 USD, expunând riscul lanțului de aprovizionare cu AI
Un cercetător Semgrep a instalat o ușă din spate ascunsă într-un model AI deschis într-o oră, pentru mai puțin de 100 USD, arătând cât de ușor pot fi armate modelele în stil Hugging Face.
Modelele AI mult mai susceptibile la ghivituri înșelătoare decât oamenii, arată un studiu PNAS
Un studiu MIT Media Lab publicat în PNAS dezvăluie că modelele de limbaj AI acceptă ghivituri înșelătoare până la 100% din timp, depășind cu mult ratele de conformitate umane.
„OCR nelimitat” de la Baidu procesează zeci de pagini de document într-o singură trecere folosind uitarea umană
Cercetătorii Baidu au construit un model OCR care gestionează zeci de pagini într-o singură trecere de inferență, menținând memoria constantă printr-un nou mecanism de atenție cu fereastră glisantă inspirat de memoria umană.
OpenAI ridică recompensa pentru bug-uri biologice la 50.000 de dolari pentru jailbreak-uri universale, în timp ce agenția britanică avertizează că amenințările cibernetice ale inteligenței artificiale vor crește
OpenAI și-a dublat recompensa pentru erori biologice la 50.000 de dolari pentru oricine găsește jailbreak-uri universale în modelele sale, deoarece Institutul de Securitate AI din Marea Britanie avertizează că capacitățile cibernetice de frontieră AI se accelerează.
OpenAI ridică recompensa pentru bug-uri biologice la 50.000 de dolari pentru jailbreak-uri universale, în timp ce agenția britanică avertizează că amenințările cibernetice ale inteligenței artificiale vor crește
OpenAI și-a dublat recompensa pentru erori biologice la 50.000 de dolari pentru oricine găsește jailbreak-uri universale în modelele sale, deoarece Institutul de Securitate AI din Marea Britanie avertizează că capacitățile cibernetice de frontieră AI se accelerează.
J-Lens de la Anthropic dezvăluie spațiul de lucru al gândirii ascunse al lui Claude, prinzând înșelăciunea înainte ca aceasta să iasă la suprafață
Cercetătorii antropici au descoperit un „spațiu J” emergent în Claude care oglindește teoria spațiului de lucru global a creierului, permițând detectarea înșelăciunii ascunse și a manipulării în rezultatele AI.
GPT-5.6 Sol Ultra de la OpenAI produce dovada unei conjecturi de acoperire dublă a ciclului de 50 de ani
GPT-5.6 Sol Ultra de la OpenAI a folosit 64 de subagenți cooperanți pentru a produce o dovadă a Conjecturei de acoperire dublă a ciclului, veche de zeci de ani, în mai puțin de o oră.
Modelul COMPASS AI prezice rezultatele imunoterapiei pentru cancer la diferite tipuri de tumori, arată studiul
Un studiu de Nature Medicine arată că COMPASS, un model de fundație pan-cancer, prezice răspunsul la imunoterapie mai precis decât biomarkerii standard pentru șapte tipuri de cancer.
Laboratoarele AMI ale lui Yann LeCun construiesc un model mondial JEPA pentru a împinge AI dincolo de modelele de limbaj mari
Laboratoarele AMI de la Yann LeCun dezvoltă un model mondial bazat pe JEPA, care argumentează despre realitatea fizică, argumentând că LLM-urile nu vor atinge niciodată inteligența la nivel uman pentru robotică.

Agentul AI Elements Claw de la Alibaba DAMO Academy descoperă 4 noi materiale supraconductoare
Academia DAMO din Alibaba spune că agentul său Elements Claw AI a descoperit în mod autonom patru noi materiale supraconductoare în 28 de ore GPU, toate verificate ulterior prin experiment fizic.

Falsificarea lanțului de gândire: cercetătorii înșelesc modelele de raționament AI, mimându-le vocea internă
Un nou atac numit CoT Forgery exploatează modul în care LLM-urile acordă prioritate stilului de scriere în detrimentul etichetelor de metadate, permițând atacatorilor să falsifice raționamentul privat al unui model pentru a trece peste instrucțiunile acestuia.
Agenții AI completează acum 16 la sută din joburile freelance la calitate profesională, arată Benchmark
Remote Labor Index arată că agenții de inteligență artificială au crescut de la 2,5% la 16,1% automatizarea muncii independente reale în opt luni, Fable 5 de la Anthropic conducând pachetul.
AI Agents Now Complete 16 Percent of Freelance Jobs at Professional Quality, Benchmark Finds
The Remote Labor Index shows AI agents jumping from 2.5% to 16.1% automation of real freelance work in eight months, with Anthropic's Fable 5 leading the pack.
Open-Weight GLM 5.2 îl depășește pe Claude în Benchmark de securitate cibernetică, constată Semgrep
Semgrep a descoperit că GLM 5.2 deschis de la Zhipu a depășit Claude Code la detectarea vulnerabilităților IDOR, obținând un scor de 39% F1 pentru aproximativ 0,17 USD per eroare găsită.
GPT-5.6 Sol trișează testele software mai mult decât orice model AI înainte de el, constată METR
Evaluatorul independent METR raportează că GPT-5.6 Sol de la OpenAI a exploatat erori și și-a ascuns urmele în timpul testării, stabilind un record pentru comportamentul de referință în jocuri.

DSpark de la DeepSeek accelerează inferența AI cu până la 85% cu o decodare speculativă mai inteligentă
Cadrul DSpark open-source al DeepSeek folosește elaborarea semi-autoregresivă și verificarea în funcție de încărcare pentru a accelera servirea LLM cu până la 85% fără pierderi de calitate.

Când AI face matematica: ce se întâmplă cu matematicienii, deoarece modelele infirmă presupunerile și câștigă aur la Olimpiada
De la Aletheia de la DeepMind care produce rezultate la nivel de doctorat la OpenAI care infirmă o presupunere de geometrie, AI remodelează matematica și forțează domeniul să se întrebe pentru ce sunt de fapt cercetătorii.
Inteligența artificială detectează riscul ascuns de moarte subită cardiacă în EKG, studiu UC Berkeley publicat în Nature Finds
O echipă condusă de UC Berkeley a antrenat o IA pe 440.000 de EKG-uri pentru a prezice moartea subită cardiacă mult mai bine decât testele standard, identificând mii de pacienți cu risc ratați prin metodele actuale.
Krea 2: Modelul Open-Weights 12B text-to-image ajunge în Top 10 pentru generarea creativă
Startup-ul Krea a lansat Krea 2, o familie de modele deschise text-to-image construite pentru explorarea creativă, clasându-se în top 10 în clasamentul Analizei artificiale.
Marea Britanie investește 60 de milioane de lire sterline în două noi laboratoare de cercetare AI pentru a face inteligența artificială mai ieftină și open source
Oxford și UCL vor conduce două noi laboratoare de inteligență artificială finanțate de guvern, axate pe modele open-source care rulează pe hardware disponibil pe scară largă, provocând dominația SUA.
NVIDIA BioNeMo Agent Toolkit oferă agenților AI instrumentele pentru a accelera descoperirea științifică
BioNeMo Agent Toolkit de la NVIDIA reunește un deceniu de biblioteci de științe ale vieții în abilități apelabile de agenți pentru proiectarea proteinelor, genomica și descoperirea medicamentelor.

Void-X: Modelul AI generativ prezice interacțiunile proteină-proteină la scară atomică, rapoartele studiului PNAS
Cercetătorii din Shanghai au construit Void-X, un model cu 172 de milioane de parametri care proiectează interfețe de proteine atom cu atom, obținând o precizie de 78% pe clusterele intra-lanț.

Inginerul AI folosește codul Claude pentru a revendica descifrarea scriptului minoic antic liniar A
Un inginer AI autodidact a construit instrumente Python cu Claude Code pentru a descifra Linear A, scriptul minoic nedescifrat. Lingviștii de la Rutgers și Cambridge analizează acum afirmația.

Metoda „Simularea implementării” OpenAI prezice eșecurile modelului înainte de lansare
Cercetătorii OpenAI propun o metodă pentru a prezice cât de des se vor comporta greșit modelele AI după lansare, folosind conversații reale. A prezis corect schimbările de risc în 92% din timp.
