arXiv
Un sito gratuito su cui i ricercatori pubblicano articoli prima della revisione formale tra pari, oppure senza passare da quel processo.
arXiv, pronunciato come la parola inglese «archive», è il luogo in cui compare per prima gran parte della ricerca sull’IA. Un ricercatore carica un articolo e questo diventa pubblico nel giro di uno o due giorni. Le riviste tradizionali impiegano mesi, talvolta più di un anno. In un settore che avanza a questa velocità è un’eternità, perciò quasi ogni risultato di cui leggi è nato come preprint su arXiv.
La rapidità si ottiene rinunciando a parte dei controlli. Un preprint non è ancora stato esaminato da esperti indipendenti incaricati di cercare errori prima della pubblicazione. La maggior parte degli articoli su arXiv è frutto di un lavoro serio, alcuni sono sbagliati e pochi altri sono marketing travestito da ricerca. Quando un titolo cita uno studio su arXiv, conviene quindi verificare se qualcuno esterno al gruppo degli autori abbia già controllato l’affermazione.
-
DeepMind ha dato a 100 agenti gli stessi compiti di matematica e si sono divisi in imbroglioni e spie
-
La risposta di Meta al tempo sprecato con la GPU: chiedi a un modello quale esperimento eseguire
-
I chatbot con intelligenza artificiale hanno gestito la propaganda straniera meglio dei motori di ricerca in un nuovo test
-
Niente AI Fridays: la proposta di uno sviluppatore per disattivare l'assistente una volta alla settimana
-
WikiSkill di Google consente agli agenti IA di tenere un wiki dei propri errori
-
LAION pubblica 10 milioni di ore di video per la ricerca sull'intelligenza artificiale aperta
-
Il co-scienziato AI di DeepMind ora gestisce l'attrezzatura del laboratorio e i medici umani sono rimasti meno impressionati rispetto ai benchmark
-
Perché le abilità di intelligenza artificiale aiutano davvero e perché 100 di esse sono peggiori di 5
-
Google ha creato un minuscolo modello di intelligenza artificiale che legge le tracce di glucosio
-
Le competenze migliorano gli agenti IA fornendo loro una lista di controllo, non fatti. E smettono di funzionare a 100 voci
-
Fornisci al modello di frontiera solo una bibliografia e chiedi l'idea. Ci arriva dal 3 al 15 per cento delle volte
-
We Are Building an Invention Meant to Outgrow Its Inventors
-
The Most Valuable AI Skill Is Not Prompting. It Is Verification.
-
Google ha trasformato un modello finito in uno molto più veloce e ha pubblicato la ricetta
-
Un vincitore della medaglia Fields che ha scritto un articolo sul rischio di estinzione dell'IA si è appena unito a OpenAI per lavorare sulla sicurezza
-
I ricercatori si sono chiesti perché i chatbot non siano efficaci con i fogli di calcolo e la risposta è più strana del previsto
-
Mistral ha rilasciato un filtro di sicurezza gratuito che descrivi in un inglese semplice e si adatta a una scheda grafica
-
Due gruppi di ricerca hanno risolto lo stesso problema aperto con lo stesso modello di intelligenza artificiale, a tre ore di distanza
-
Meta ha dato al suo agente IA un secondo agente con un solo compito: ricordare
-
Come interrogare un PDF di 100 pagine e verificare che non inventi le risposte
-
Anthropic: Claude ha scoperto due vere debolezze negli algoritmi crittografici
-
Substack introduce un rilevatore di IA e gli autori si ribellano
-
METR propone un nuovo modo per chiedere se un agente IA costa davvero meno di una persona
-
Sakana sostiene che il suo router ora superi persino un modello che non utilizza
-
Barare con l’IA diventa più facile e più difficile da dimostrare
-
Orca: un nuovo tipo di IA che impara come funziona il mondo osservandolo
-
I ricercatori hanno affidato una startup ai modelli IA per 500 giorni. Quasi tutti sono falliti.