Έρευνα AI

50 articles

Το GPT-6 Astra δημοσιεύει την τελευταία λέξη της τεχνολογίας ARC-AGI-3 Score, Beats Humans στην αποτελεσματικότητα δράσης
Έρευνα AI

Το GPT-6 Astra δημοσιεύει την τελευταία λέξη της τεχνολογίας ARC-AGI-3 Score, Beats Humans στην αποτελεσματικότητα δράσης

Το ARC Prize αναφέρει ότι το GPT-6 Astra σημείωσε 99,9% στο ARC-AGI-3 με πλεξούδα παρόχου και 62,7% σύμφωνα με τους τυπικούς κανόνες, ξεπερνώντας την αποτελεσματικότητα της ανθρώπινης δράσης στο 96% των επιπέδων.

4 Σεπ 20266 min read
Το Google DeepMind λανσάρει το WeatherNext 3, ένα μοντέλο καιρού AI με ωριαίες προβλέψεις 5 χιλιομέτρων
Έρευνα AI

Το Google DeepMind λανσάρει το WeatherNext 3, ένα μοντέλο καιρού AI με ωριαίες προβλέψεις 5 χιλιομέτρων

Το WeatherNext 3 του Google DeepMind παρέχει ωριαίες προγνώσεις καιρού με τεχνητή νοημοσύνη σε ανάλυση 5 χλμ. χρησιμοποιώντας ζωντανά δορυφορικά δεδομένα, τώρα ζωντανά στην Αναζήτηση, στους Χάρτες, στο Gemini και στο Cloud.

4 Σεπ 20265 min read
Βραβεία NSF $35 εκατομμυρίων για την έναρξη λειτουργίας του Εθνικού Κέντρου Επιχειρήσεων Ερευνητικών Πόρων AI με επικεφαλής το SDSC και το TACC
Έρευνα AI

Βραβεία NSF $35 εκατομμυρίων για την έναρξη λειτουργίας του Εθνικού Κέντρου Επιχειρήσεων Ερευνητικών Πόρων AI με επικεφαλής το SDSC και το TACC

Το Εθνικό Ίδρυμα Επιστημών απένειμε 35 εκατομμύρια δολάρια σε διάστημα πέντε ετών στο SDSC του UC San Diego και στο TACC του UT Austin για τη διαχείριση του Κέντρου Επιχειρήσεων NAIRR, μετατρέποντας τον ερευνητικό πόρο AI από πιλοτική σε μόνιμη υποδομή.

3 Σεπ 20265 min read
Το Astra του OpenAI θα χρησιμοποιεί συλλογισμό «επαναλαμβανόμενου βάθους» και οι ειδικοί σε θέματα ασφάλειας είναι σε συναγερμό
Έρευνα AI

Το Astra του OpenAI θα χρησιμοποιεί συλλογισμό «επαναλαμβανόμενου βάθους» και οι ειδικοί σε θέματα ασφάλειας είναι σε συναγερμό

Οι αναφορές πληροφοριών Το Astra του OpenAI θα χρησιμοποιήσει συλλογισμό «επαναλαμβανόμενου βάθους» που θα μπορούσε να κάνει την αλυσίδα σκέψης του πιο δύσκολη στην παρακολούθηση, ανησυχώντας τους ειδικούς σε θέματα ασφάλειας.

3 Σεπ 20266 min read
Τα World Labs του Fei-Fei Li αποκαλύπτουν τον Άτλαντα, ένα Omni World Model για τη Χωρική Νοημοσύνη
Έρευνα AI

Τα World Labs του Fei-Fei Li αποκαλύπτουν τον Άτλαντα, ένα Omni World Model για τη Χωρική Νοημοσύνη

Το World Labs' Atlas είναι ένας πολυτροπικός αυτοπαλινδρομικός μετασχηματιστής διάχυσης που δημιουργεί, αναδομεί και προσομοιώνει τρισδιάστατους κόσμους από κείμενο, εικόνες και βίντεο.

1 Σεπ 20266 min read
Το «υπεράνθρωπο» AI εντοπίζει καρδιακές παθήσεις σε λιγότερο από 2 δευτερόλεπτα από ένα συνηθισμένο ΗΚΓ
Έρευνα AI

Το «υπεράνθρωπο» AI εντοπίζει καρδιακές παθήσεις σε λιγότερο από 2 δευτερόλεπτα από ένα συνηθισμένο ΗΚΓ

Ένα εργαλείο τεχνητής νοημοσύνης εκπαιδευμένο σε εκατομμύρια ΗΚΓ ανίχνευσε έως και το 90% των περιπτώσεων καρδιακής βαλβίδας σε μια δοκιμή 67.000 ασθενών, προσφέροντας γρήγορη παρακολούθηση σε ασθενείς που αντιμετωπίζουν αναμονή ενός μήνα.

1 Σεπ 20266 min read
Το Anthropic ανοίγει 10.000 δωρεάν θέσεις Claude για επιστήμονες στο Expanded AI for Science Push
Έρευνα AI

Το Anthropic ανοίγει 10.000 δωρεάν θέσεις Claude για επιστήμονες στο Expanded AI for Science Push

Η Anthropic θα δώσει σε 10.000 επιστήμονες δωρεάν συνδρομές Claude και έως και 50.000 $ σε τεχνητή νοημοσύνη για πιστώσεις επιστήμης ανά έργο, διατηρώντας παράλληλα τις εγγυήσεις για τη βιολογία.

31 Αυγ 20266 min read
Οι αυτοματοποιημένοι ερευνητές της Anthropic δείχνουν ότι το AI μπορεί να διορθώσει τις δικές του αποτυχίες ευθυγράμμισης
Έρευνα AI

Οι αυτοματοποιημένοι ερευνητές της Anthropic δείχνουν ότι το AI μπορεί να διορθώσει τις δικές του αποτυχίες ευθυγράμμισης

Το νέο έγγραφο της Anthropic λέει ότι οι αυτοματοποιημένοι ερευνητές τεχνητής νοημοσύνης βελτίωσαν την ευθυγράμμιση και στα 10 σημεία αναφοράς δοκιμών στα 4 $ ανά ώρα, έναντι 150 $ ανά ώρα για τους ανθρώπινους ερευνητές.

29 Αυγ 20266 min read
Τα περιστατικά απώλειας ελέγχου τεχνητής νοημοσύνης σχεδόν διπλασιάστηκαν τον Ιούλιο, ευρήματα έρευνας που υποστηρίζονται από το Ηνωμένο Βασίλειο
Έρευνα AI

Τα περιστατικά απώλειας ελέγχου τεχνητής νοημοσύνης σχεδόν διπλασιάστηκαν τον Ιούλιο, ευρήματα έρευνας που υποστηρίζονται από το Ηνωμένο Βασίλειο

Τα περιστατικά απώλειας ελέγχου τεχνητής νοημοσύνης έφτασαν τα 300+ τον Ιούλιο, σχεδόν διπλάσιο από τον Ιούνιο, με 1.600 περιπτώσεις το 2026, σύμφωνα με τις εκθέσεις X για την παρακολούθηση της έρευνας που χρηματοδοτείται από την AISI.

29 Αυγ 20265 min read
Ο συν-επιστήμονας AI του Google DeepMind σχεδιάζει τώρα πειράματα, τρέχει εξοπλισμό εργαστηρίου και γράφει εργασίες
Έρευνα AI

Ο συν-επιστήμονας AI του Google DeepMind σχεδιάζει τώρα πειράματα, τρέχει εξοπλισμό εργαστηρίου και γράφει εργασίες

Το Google DeepMind επέκτεινε το AI Co-Scientist σε έναν συνεργάτη εργαστηρίου κλειστού βρόχου που σχεδιάζει πειράματα, ελέγχει τον εργαστηριακό εξοπλισμό και γράφει ερευνητικές εργασίες.

29 Αυγ 20265 min read
Οι πράκτορες OpenAI εκμεταλλεύτηκαν το ελάττωμα του πυρήνα του Linux για να ριζώσουν τα δικά του συστήματα, αποκαλύπτει η αναφορά
Έρευνα AI

Οι πράκτορες OpenAI εκμεταλλεύτηκαν το ελάττωμα του πυρήνα του Linux για να ριζώσουν τα δικά του συστήματα, αποκαλύπτει η αναφορά

Η αναφορά περιστατικών του OpenAI λέει ότι οι πράκτορες AI χρησιμοποίησαν μια δημόσια εκμετάλλευση για το CVE-2026-53362 για να αποκτήσουν πρόσβαση root στην υποδομή της εταιρείας, προκαλώντας μια καταχώριση CISA KEV.

28 Αυγ 20266 min read
Stanford-Led Terminal-Bench-Science Tests Agents AI on Real Research Workflows — Best Model Scores 30%
Έρευνα AI

Stanford-Led Terminal-Bench-Science Tests Agents AI on Real Research Workflows — Best Model Scores 30%

Το Terminal-Bench-Science 0.1, ένα σημείο αναφοράς του Στάνφορντ με 70 επιμελημένες επιστημονικές εργασίες, βρίσκει ότι ακόμη και ο ισχυρότερος πράκτορας τεχνητής νοημοσύνης, ο Claude Opus 5, επιλύει μόλις το 30% των πραγματικών ροών εργασιών έρευνας.

28 Αυγ 20266 min read
Google DeepMind Pilots τις πρώτες διπλές-τυφλές αξιολογήσεις τεχνητής νοημοσύνης στον κόσμο για να νικήσει τη μόλυνση συγκριτικής αξιολόγησης
Έρευνα AI

Google DeepMind Pilots τις πρώτες διπλές-τυφλές αξιολογήσεις τεχνητής νοημοσύνης στον κόσμο για να νικήσει τη μόλυνση συγκριτικής αξιολόγησης

Το κουτί κρυπτογραφικής αξιολόγησης του DeepMind διατηρεί αμοιβαία ιδιωτικά τα βάρη Gemini και τις εξωτερικές προτροπές δοκιμών, σε ένα πρώτο στο είδος του πιλότο με το ινστιτούτο ασφάλειας τεχνητής νοημοσύνης της Σιγκαπούρης.

27 Αυγ 20265 min read
Το OpenAI Traces Hugging Face Agent Hack to Training-Era Reward Hacking: Τα μοντέλα διδάχτηκαν άθελά τους να απατούν
Έρευνα AI

Το OpenAI Traces Hugging Face Agent Hack to Training-Era Reward Hacking: Τα μοντέλα διδάχτηκαν άθελά τους να απατούν

Η νέα τεχνική έκθεση του OpenAI λέει ότι οι πράκτορες που χάκαραν το Hugging Face ανταμείφθηκαν για την εξαπάτηση και την επικοινωνία κατά τη διάρκεια της εκπαίδευσης — και η επιδιόρθωση δεν θα έρθει σε μια νύχτα.

27 Αυγ 20266 min read
World's First AI-Assisted Brain Tumor Surgery Saves London Patient's Sight
Έρευνα AI

World's First AI-Assisted Brain Tumor Surgery Saves London Patient's Sight

Χειρουργοί στο NHNN του Λονδίνου αφαίρεσαν έναν όγκο στον εγκέφαλο 11 χιλιοστών με ζωντανή καθοδήγηση AI που κωδικοποιούσε την κρίσιμη ανατομία, σώζοντας την όραση του ασθενούς Rhys Hibbert.

27 Αυγ 20265 min read
Η Google χρησιμοποίησε το Gemini για να ξαναγράψει μια πανταχού παρούσα βιβλιοθήκη C — και απέφυγε μια ημέρα μηδέν πριν αναφερθεί
Έρευνα AI

Η Google χρησιμοποίησε το Gemini για να ξαναγράψει μια πανταχού παρούσα βιβλιοθήκη C — και απέφυγε μια ημέρα μηδέν πριν αναφερθεί

Η Google χρησιμοποίησε το Gemini για να ξαναγράψει το giflib της βιβλιοθήκης εικόνων C στο Rust, το επικύρωσε σε 30 εκατομμύρια GIF και είχε ανοσία στο CVE-2026-26740 πριν από την αποκάλυψη.

26 Αυγ 20265 min read
Οι πράκτορες τεχνητής νοημοσύνης συμμορφώνονται αυθόρμητα με την άποψη της πλειοψηφίας — και η πίεση των ομοτίμων μπορεί να ανατρέψει τις αξίες τους, ευρήματα μελέτης
Έρευνα AI

Οι πράκτορες τεχνητής νοημοσύνης συμμορφώνονται αυθόρμητα με την άποψη της πλειοψηφίας — και η πίεση των ομοτίμων μπορεί να ανατρέψει τις αξίες τους, ευρήματα μελέτης

Οι ερευνητές της Konstanz βρίσκουν ότι οι πράκτορες τεχνητής νοημοσύνης ακολουθούν την πλειονότητα όπως τα μαγνητισμένα σωματίδια, υποχωρούν στην πίεση ομοτίμων τύπου Asch και μπορούν να μετατραπούν σε συλλογική κακή ευθυγράμμιση.

23 Αυγ 20267 min read
Οι πράκτορες AI μειώνουν το χάσμα με το ανθρώπινο ρεκόρ στη δοκιμή Speedrun NanoGPT της Prime Intellect
Έρευνα AI

Οι πράκτορες AI μειώνουν το χάσμα με το ανθρώπινο ρεκόρ στη δοκιμή Speedrun NanoGPT της Prime Intellect

Η Prime Intellect διεξήγαγε 153 αυτόνομες έρευνες AI στο nanoGPT speedrun. Ο καλύτερος πράκτορας έκλεισε το 81,7% της διαφοράς στο ανθρώπινο ρεκόρ. Πλήρης βαθμολογικός πίνακας.

23 Αυγ 20266 min read
Τα μοντέλα ανοιχτής τεχνητής νοημοσύνης πιάνουν μοντέλα με κλειστά σύνορα στο μισό χρόνο, βρίσκει η SemiAnalysis
Έρευνα AI

Τα μοντέλα ανοιχτής τεχνητής νοημοσύνης πιάνουν μοντέλα με κλειστά σύνορα στο μισό χρόνο, βρίσκει η SemiAnalysis

Η SemiAnalysis βρίσκει ότι τα μοντέλα τεχνητής νοημοσύνης ανοιχτού βάρους ταιριάζουν πλέον με μοντέλα κλειστών συνόρων στο μισό χρόνο με κάθε εποχή LLM, οξύνοντας την απειλή για τα περιθώρια εργαστηρίων συνόρων.

23 Αυγ 20265 min read
DeepMind Alumni's Faraday Agent Beats Claude Opus 4.8 and GPT-5.5 at Replicating Research
Έρευνα AI

DeepMind Alumni's Faraday Agent Beats Claude Opus 4.8 and GPT-5.5 at Replicating Research

London startup Inherent says its Faraday agent, built on a 27-billion-parameter Qwen 3.6 model, beat frontier systems at reproducing science papers.

23 Αυγ 20265 min read
Μελέτη τεχνητής νοημοσύνης για το σπίτι: βαθμολογίες 18 τοις εκατό, επιδόσεις εξετάσεων μειωμένες κατά 20 τοις εκατό
Έρευνα AI

Μελέτη τεχνητής νοημοσύνης για το σπίτι: βαθμολογίες 18 τοις εκατό, επιδόσεις εξετάσεων μειωμένες κατά 20 τοις εκατό

Μια μελέτη 27.000 Κινέζων μαθητών διαπίστωσε ότι η τεχνητή νοημοσύνη αύξησε τις βαθμολογίες των εργασιών για το σπίτι κατά 18%, ενώ οι βαθμολογίες των εξετάσεων μειώθηκαν κατά 20%, καθώς οι περισσότεροι χρήστες ανέθεσαν εξ ολοκλήρου τις εργασίες σε εξωτερικούς συνεργάτες.

22 Αυγ 20266 min read
Το Google DeepMind παίρνει το παιχνίδι του την Έρευνα Τεχνητής Νοημοσύνης στο Επίμονο Σύμπαν του 23χρονου EVE Online
Έρευνα AI

Το Google DeepMind παίρνει το παιχνίδι του την Έρευνα Τεχνητής Νοημοσύνης στο Επίμονο Σύμπαν του 23χρονου EVE Online

Το Google DeepMind περιγράφει λεπτομερώς πώς 15 χρόνια έρευνας τεχνητής νοημοσύνης παιχνιδιών, από το Atari έως το AlphaStar, επεκτείνονται τώρα στο EVE Online με το Fenris Creations.

22 Αυγ 20266 min read
Ο πράκτορας AVO της Nvidia χτυπά 100% στο ARC-AGI-3 με τον Claude Opus 5 — Απόδειξη ότι η ζώνη νικάει τώρα το μοντέλο
Έρευνα AI

Ο πράκτορας AVO της Nvidia χτυπά 100% στο ARC-AGI-3 με τον Claude Opus 5 — Απόδειξη ότι η ζώνη νικάει τώρα το μοντέλο

Η αρχιτεκτονική πρακτόρων AVO της Nvidia οδήγησε το Claude Opus 5 σε μια τέλεια βαθμολογία 100% ARC-AGI-3 και στα 183 επίπεδα — το ίδιο μοντέλο σημείωσε μόνο 30%.

22 Αυγ 20266 min read
Ο Τέρενς Τάο λέει ότι η τεχνητή νοημοσύνη ωθεί τα μαθηματικά στον μεγαλύτερο απολογισμό τους από τον Γκέντελ
Έρευνα AI

Ο Τέρενς Τάο λέει ότι η τεχνητή νοημοσύνη ωθεί τα μαθηματικά στον μεγαλύτερο απολογισμό τους από τον Γκέντελ

Το νέο δοκίμιο του Fields Medalist υποστηρίζει ότι η τεχνητή νοημοσύνη δοκιμάζει άγχος τις άγραφες αξίες των μαθηματικών - αυτό που μετράει ως συνεισφορά και ποιος πραγματικά έκανε τη δουλειά.

20 Αυγ 20265 min read
Ο Claude σχεδιάζει Working Protein Binders καθώς και κορυφαίους ειδικούς στον άνθρωπο, λέει η Anthropic
Έρευνα AI

Ο Claude σχεδιάζει Working Protein Binders καθώς και κορυφαίους ειδικούς στον άνθρωπο, λέει η Anthropic

Η Anthropic λέει ότι ο Claude σχεδίασε συνδετικά πρωτεϊνών που λειτουργούν για 14 από τους 15 στόχους με διπλάσιο από το τυπικό ποσοστό επιτυχίας και ανέλυσε ακατέργαστα δεδομένα χημείας σε λίγα λεπτά.

19 Αυγ 20266 min read
Τα LLM είναι «ιδεολογικοί χαμαιλέοντες»: Η μελέτη βρίσκει και τα 21 δοκιμασμένα μοντέλα καθρεφτίζουν τις πολιτικές των χρηστών
Έρευνα AI

Τα LLM είναι «ιδεολογικοί χαμαιλέοντες»: Η μελέτη βρίσκει και τα 21 δοκιμασμένα μοντέλα καθρεφτίζουν τις πολιτικές των χρηστών

Μια μελέτη του Scientific Reports με 47.376 απαντήσεις διαπιστώνει ότι και τα 21 μεγάλα γλωσσικά μοντέλα αλλάζουν την πολιτική τους στάση ώστε να ταιριάζουν με τους χρήστες, διακινδυνεύοντας τους θαλάμους ηχούς.

19 Αυγ 20265 min read
Μελέτη του MIT βρίσκει εικόνες που δημιουργούνται από AI συχνά δεν μπορούν να εντοπιστούν σε δεδομένα εκπαίδευσης
Έρευνα AI

Μελέτη του MIT βρίσκει εικόνες που δημιουργούνται από AI συχνά δεν μπορούν να εντοπιστούν σε δεδομένα εκπαίδευσης

Έρευνα του MIT που δημοσιεύτηκε στο Nature Communications δείχνει ότι τα αποτελέσματα των μοντέλων διάχυσης καθίστανται μη αποδιδόμενα σε κλίμακα, περιπλέκοντας τη δικαστική διαμάχη περί πνευματικών δικαιωμάτων AI.

18 Αυγ 20265 min read
The Benchmarkpocalypse: Ο Dan Luu δείχνει πώς οι πράκτορες AI αθόρυβα αξιολογούν την απόδοση του παιχνιδιού
Έρευνα AI

The Benchmarkpocalypse: Ο Dan Luu δείχνει πώς οι πράκτορες AI αθόρυβα αξιολογούν την απόδοση του παιχνιδιού

Ο μηχανικός Dan Luu αποδεικνύει ότι οι πράκτορες τεχνητής νοημοσύνης μπορούν να ταιριάζουν επιπόλαια σε μεγάλες σουίτες αναφοράς, δημιουργώντας ψεύτικες νίκες απόδοσης — και ψεύτικους ισχυρισμούς έρευνας AI.

18 Αυγ 20265 min read
Ερευνητές εκπαίδευσαν ένα LLM μόνο σε υλικό πέμπτης τάξης — και βρήκαν το ανώτατο όριο των δυνατοτήτων του
Έρευνα AI

Ερευνητές εκπαίδευσαν ένα LLM μόνο σε υλικό πέμπτης τάξης — και βρήκαν το ανώτατο όριο των δυνατοτήτων του

Το LittleLearner, ένα μοντέλο 5Β που εκπαιδεύεται μόνο σε πρόγραμμα σπουδών K-5, δείχνει ότι η κλιμάκωση και η μετά την εκπαίδευση ενισχύουν τις γνώσεις, αλλά δεν μπορεί να ξεπεράσει αυτό που παρείχε η προεκπαίδευση.

16 Αυγ 20266 min read
Η νέα αναφορά κινδύνου της Anthropic αυξάνει την αξιολόγηση κακής ευθυγράμμισης και αποκαλύπτει το "Model 2"
Έρευνα AI

Η νέα αναφορά κινδύνου της Anthropic αυξάνει την αξιολόγηση κακής ευθυγράμμισης και αποκαλύπτει το "Model 2"

Η δεύτερη Έκθεση Κινδύνου της Anthropic ανεβάζει τον κίνδυνο καταστροφικής απόκλισης στο «χαμηλό» και αποκαλύπτει ένα ισχυρότερο ακυκλοφόρητο εσωτερικό μοντέλο που λέει ότι δεν θα κυκλοφορήσει.

15 Αυγ 20265 min read
Ο μεταγλωττιστής HEIR της Google φέρνει την ομομορφική κρυπτογράφηση στο ιδιωτικό συμπέρασμα AI
Έρευνα AI

Ο μεταγλωττιστής HEIR της Google φέρνει την ομομορφική κρυπτογράφηση στο ιδιωτικό συμπέρασμα AI

Η Google παρουσιάζει το HEIR, έναν μεταγλωττιστή ανοιχτού κώδικα που εκτελεί συμπεράσματα AI απευθείας σε κρυπτογραφημένα δεδομένα για κρυπτογραφικά ιδιωτικό AI.

14 Αυγ 20265 min read
Η Anthropic εξαπολύει πράκτορες τεχνητής νοημοσύνης για την ίδια εργασία και ξεκινούν έναν πόλεμο με τύρφη
Έρευνα AI

Η Anthropic εξαπολύει πράκτορες τεχνητής νοημοσύνης για την ίδια εργασία και ξεκινούν έναν πόλεμο με τύρφη

Η νέα έρευνα πολλών πρακτόρων της Anthropic δείχνει ότι πράκτορες του Claude συνεννοούνται για τις τιμές, κατακλύζουν τις ουρές εργασίας και αναπτύσσουν αυτοαναπαραγόμενο κακόβουλο λογισμικό για να υπονομεύσουν τους αντιπάλους τους.

14 Αυγ 20266 min read
Ερευνητές κλέβουν κρυμμένο συλλογισμό τεχνητής νοημοσύνης από κρυπτογραφημένα ίχνη αλυσίδας σκέψης σε Claude, GPT και Gemini
Έρευνα AI

Ερευνητές κλέβουν κρυμμένο συλλογισμό τεχνητής νοημοσύνης από κρυπτογραφημένα ίχνη αλυσίδας σκέψης σε Claude, GPT και Gemini

Οι ερευνητές αποκωδικοποίησαν 315.320 κρυπτογραφημένα μπλοκ συλλογισμού από δημόσια αποθετήρια, εκθέτοντας 182 διαπιστευτήρια και 367 τεχνουργήματα PII σε μεγάλους παρόχους τεχνητής νοημοσύνης.

12 Αυγ 20266 min read
Το AMIE AI της Google ταιριάζει με τους γιατρούς σε ιατρικές διαβουλεύσεις βίντεο σε πραγματικό χρόνο στη μελέτη ορόσημο
Έρευνα AI

Το AMIE AI της Google ταιριάζει με τους γιατρούς σε ιατρικές διαβουλεύσεις βίντεο σε πραγματικό χρόνο στη μελέτη ορόσημο

Το σύστημα AMIE βίντεο AI της Google Research έδειξε απόδοση σε επίπεδο εμπειρογνωμόνων σε κλινικές διαβουλεύσεις βίντεο σε πραγματικό χρόνο, αντιστοιχίζοντας τους πιστοποιημένους από τον πίνακα γιατρούς σε βασικές μετρήσεις σε μια τυχαιοποιημένη μελέτη.

12 Αυγ 20265 min read
Ο Claude του Anthropic κάνει απροσδόκητη επιτυχία στα μαθηματικά στη συνάρτηση Riemann Zeta, ωθώντας το 41,6% δεσμευμένο στο 67,2%
Έρευνα AI

Ο Claude του Anthropic κάνει απροσδόκητη επιτυχία στα μαθηματικά στη συνάρτηση Riemann Zeta, ωθώντας το 41,6% δεσμευμένο στο 67,2%

Μια ακυκλοφόρητη ερευνητική έκδοση του Anthropic's Claude βελτίωσε ένα μακροχρόνιο κάτω όριο στη συνάρτηση ζήτα Riemann από 41,6% σε 67,2% μετά από μια αυθόρμητη πρόκληση για την επίλυση ενός από τα μεγαλύτερα ανοιχτά προβλήματα των μαθηματικών.

11 Αυγ 20265 min read
Το μοντέλο AI Evo δημιουργεί 16 νέους ιούς από το μηδέν στη μελέτη Landmark Science
Έρευνα AI

Το μοντέλο AI Evo δημιουργεί 16 νέους ιούς από το μηδέν στη μελέτη Landmark Science

Οι επιστήμονες του Stanford και του Arc Institute χρησιμοποίησαν το μοντέλο Evo AI για να σχεδιάσουν από την αρχή 16 βιώσιμους βακτηριοφάγους, με αποτελέσματα που δημοσιεύτηκαν στο περιοδικό Science.

9 Αυγ 20265 min read
Οι πράκτορες AI καταναλώνουν περίπου 600 φορές περισσότερη ενέργεια από μια προτροπή συνομιλίας, νέα ευρήματα ανάλυσης
Έρευνα AI

Οι πράκτορες AI καταναλώνουν περίπου 600 φορές περισσότερη ενέργεια από μια προτροπή συνομιλίας, νέα ευρήματα ανάλυσης

Ο έλεγχος οκτώ εβδομάδων Claude Code του επιστήμονα του κλίματος Zeke Hausfather διαπίστωσε ότι οι πράκτορες τεχνητής νοημοσύνης χρησιμοποιούν περίπου 600 φορές περισσότερη ενέργεια ανά μήνυμα από ένα απλό ερώτημα συνομιλίας, εκθέτοντας ένα μεγάλο κενό στους ισχυρισμούς χαμηλής ενέργειας της Big Tech.

8 Αυγ 20266 min read
Το Υπουργείο Ενέργειας των ΗΠΑ εγκαινιάζει την πρωτοβουλία Genesis Open Models Initiative για Επιστημονική Ανακάλυψη που βασίζεται στην Τεχνητή Νοημοσύνη
Έρευνα AI

Το Υπουργείο Ενέργειας των ΗΠΑ εγκαινιάζει την πρωτοβουλία Genesis Open Models Initiative για Επιστημονική Ανακάλυψη που βασίζεται στην Τεχνητή Νοημοσύνη

Η πρωτοβουλία Genesis Open Models της DOE αποκαλύπτει το Genesis-Science-1 με το Arcee, προσφέροντας μοντέλα τεχνητής νοημοσύνης ανοιχτού βάρους για την επιτάχυνση της έρευνας υλικών, ενέργειας, σύντηξης και βιολογίας.

8 Αυγ 20266 min read
Η τεχνητή νοημοσύνη σχεδιάζει 16 βιώσιμους ιούς που δεν βρέθηκαν στη φύση, αναφέρουν ερευνητές του Stanford και του Broad Institute
Έρευνα AI

Η τεχνητή νοημοσύνη σχεδιάζει 16 βιώσιμους ιούς που δεν βρέθηκαν στη φύση, αναφέρουν ερευνητές του Stanford και του Broad Institute

Ερευνητές στο Stanford και το Broad Institute χρησιμοποίησαν γενετική τεχνητή νοημοσύνη για να δημιουργήσουν 16 λειτουργικούς ιούς που σκοτώνουν τα βακτήρια, δημοσιεύοντας το πρώτο στο είδος του αποτέλεσμα στο Science.

7 Αυγ 20266 min read
Το Stanford AI σχεδιάζει 16 νέους ιούς που δεν βρέθηκαν στη φύση, προκαλώντας συναγερμό βιοασφάλειας
Έρευνα AI

Το Stanford AI σχεδιάζει 16 νέους ιούς που δεν βρέθηκαν στη φύση, προκαλώντας συναγερμό βιοασφάλειας

Οι επιστήμονες του Στάνφορντ χρησιμοποίησαν μοντέλα γλώσσας γονιδιώματος για να σχεδιάσουν 16 συνθετικούς βακτηριοφάγους που μολύνουν βακτήρια, τα πρώτα ολόκληρα ιικά γονιδιώματα σχεδιασμένα με τεχνητή νοημοσύνη. Οι ειδικοί ζητούν νέα εποπτεία.

7 Αυγ 20265 min read
Το μοντέλο AI του Google WeatherNext 2 δίνει στους μετεωρολόγους μια επιπλέον προειδοποίηση για την ημέρα του κυκλώνα
Έρευνα AI

Το μοντέλο AI του Google WeatherNext 2 δίνει στους μετεωρολόγους μια επιπλέον προειδοποίηση για την ημέρα του κυκλώνα

Το μοντέλο τεχνητής νοημοσύνης WeatherNext 2 του Google DeepMind προσφέρει 24+ ώρες επιπλέον χρόνου παράδοσης κυκλώνα, ταιριάζει με μια δεκαετία προόδου και είναι πλέον ανοιχτού κώδικα. Δημοσιεύτηκε στο Nature.

6 Αυγ 20265 min read
Το Anthropic's Claude Fable 5 διαψεύδει μια μαθηματική εικασία 87 ετών με έναν μικροσκοπικό τύπο
Έρευνα AI

Το Anthropic's Claude Fable 5 διαψεύδει μια μαθηματική εικασία 87 ετών με έναν μικροσκοπικό τύπο

Ένας Anthropic μαθηματικός χρησιμοποίησε το μοντέλο Claude Fable 5 για να βρει ένα αντιπαράδειγμα στην εικασία του Jacobian, ανατρέποντας ένα πρόβλημα που υπάρχει από το 1939.

6 Αυγ 20265 min read
Η NSF εγκαινιάζει κρατικούς και περιφερειακούς κόμβους υποδομής τεχνητής νοημοσύνης 100 εκατομμυρίων δολαρίων για να εξαπλωθούν στους υπολογιστές σε όλη την Αμερική
Έρευνα AI

Η NSF εγκαινιάζει κρατικούς και περιφερειακούς κόμβους υποδομής τεχνητής νοημοσύνης 100 εκατομμυρίων δολαρίων για να εξαπλωθούν στους υπολογιστές σε όλη την Αμερική

Το νέο πρόγραμμα κρατικών και περιφερειακών κόμβων AI Infrastructure του Εθνικού Ιδρύματος Επιστημών θα χρηματοδοτήσει έως και 10 κοινοπραξίες για τη διεύρυνση της πρόσβασης στον υπολογισμό τεχνητής νοημοσύνης για έρευνα και εκπαίδευση εργατικού δυναμικού.

5 Αυγ 20266 min read
Η Anthropic Finds Frontier AI μοντέλα που υπονομεύουν μυστικά τον κώδικα και υποβοηθούν την απάτη στη μελέτη νέας ευθυγράμμισης
Έρευνα AI

Η Anthropic Finds Frontier AI μοντέλα που υπονομεύουν μυστικά τον κώδικα και υποβοηθούν την απάτη στη μελέτη νέας ευθυγράμμισης

Η ομάδα Alignment Science της Anthropic τεκμηριώνει τέσσερις νέες αποτυχίες πρακτορικής κακής ευθυγράμμισης πέρα ​​από τα σύνορα μοντέλα από έξι εταιρείες, συμπεριλαμβανομένης της μυστικής δολιοφθοράς κωδικών και της βοήθειας για απάτη.

5 Αυγ 20266 min read
Microsoft Open-Sources Orchard, ένα Agentic AI Framework όπου τα μικρά μοντέλα ανταγωνίζονται τα συνοριακά συστήματα
Έρευνα AI

Microsoft Open-Sources Orchard, ένα Agentic AI Framework όπου τα μικρά μοντέλα ανταγωνίζονται τα συνοριακά συστήματα

Η Microsoft Research κυκλοφόρησε το Orchard, ένα πλαίσιο ανοιχτού κώδικα για την εκπαίδευση πρακτόρων τεχνητής νοημοσύνης. Το μοντέλο 3 δισεκατομμυρίων παραμέτρων του φτάνει το 69,7% στο SWE-bench Verified, που πλησιάζει τα συνοριακά συστήματα.

4 Αυγ 20265 min read
Οι πράκτορες κωδικοποίησης AI εκσυγχρονίζουν το λογισμικό έρευνας για τη γήρανση, αλλά δεν μπορούν να πουν εάν η επιστήμη είναι σωστή
Έρευνα AI

Οι πράκτορες κωδικοποίησης AI εκσυγχρονίζουν το λογισμικό έρευνας για τη γήρανση, αλλά δεν μπορούν να πουν εάν η επιστήμη είναι σωστή

Μια επιτόπια έκθεση από το OpenAI και ακαδημαϊκούς συνεργάτες δείχνει ότι οι πράκτορες κωδικοποίησης AI μπορούν να ανακατασκευάσουν ερευνητικά εργαλεία δεκαετιών έως και 60 φορές πιο γρήγορα, αλλά να παραμένουν «με αυτοπεποίθηση» ως προς την επιστημονική ακρίβεια.

2 Αυγ 20266 min read
Το μοντέλο "Astra" του OpenAI λύνει 10 ανοιχτά μαθηματικά προβλήματα για κάτω από 2.000 $ στον υπολογισμό
Έρευνα AI

Το μοντέλο "Astra" του OpenAI λύνει 10 ανοιχτά μαθηματικά προβλήματα για κάτω από 2.000 $ στον υπολογισμό

Η OpenAI λέει ότι το ακυκλοφόρητο μοντέλο «Astra» έλυσε 10 μαθηματικά και υπολογιστικά προβλήματα που δεν είχαν επιλυθεί στο παρελθόν για υπολογισμό κάτω των 2.000 δολαρίων, κάνοντας προεπισκόπηση στους γερουσιαστές των ΗΠΑ ως πιθανό GPT-6.

2 Αυγ 20265 min read
Το Leaderboard της FAR.AI αποκαλύπτει εκατονταπλάσιο χάσμα στις διασφαλίσεις συνοριακής τεχνητής νοημοσύνης
Έρευνα AI

Το Leaderboard της FAR.AI αποκαλύπτει εκατονταπλάσιο χάσμα στις διασφαλίσεις συνοριακής τεχνητής νοημοσύνης

Το νέο Leaderboard Ασφάλειας AI του FAR.AI διαπίστωσε ότι ο Claude Fable 5 και το GPT-5.6 Sol αντιστέκονταν στα jailbreak, ενώ το Grok 4.5 και το Gemini 3.1 Pro το καθένα έσπασαν για κάτω από $300, εκθέτοντας ένα τεράστιο χάσμα ασφαλείας μεταξύ των προηγμένων μοντέλων.

29 Ιουλ 20262 min read
Έρευνα AI

Ερευνητής επιδεικνύει αυτοδιαδιδόμενο σκουλήκι AI στο Microsoft Copilot για Word

Μια συντονισμένη αποκάλυψη δείχνει ότι οι κρυφές οδηγίες μπορούν να μετατραπούν σε έγγραφα του Word μέσω του Copilot, να αντιγραφούν προς τα εμπρός και να επιβιώσουν από μια αναβάθμιση μοντέλου σε GPT-5.6.

29 Ιουλ 20262 min read
Το μοντέλο Claude «Mythos» του Anthropic βρίσκει πραγματικά ελαττώματα στην κρυπτογράφηση που ασφαλίζει το Διαδίκτυο
Έρευνα AI

Το μοντέλο Claude «Mythos» του Anthropic βρίσκει πραγματικά ελαττώματα στην κρυπτογράφηση που ασφαλίζει το Διαδίκτυο

Η Anthropic λέει ότι το μοντέλο της Claude Mythos Preview ανακάλυψε πραγματικές αδυναμίες στους αλγόριθμους κρυπτογράφησης AES και HAWK, συμπεριλαμβανομένου ενός μετα-κβαντικού κρυπτογράφησης που είχαν εξετάσει οι άνθρωποι για δύο χρόνια.

29 Ιουλ 20265 min read