Nel dinamico e competitivo panorama dell'intelligenza artificiale, una nuova realtà londinese, Inherent, sta rapidamente emergendo, catturando l'attenzione degli esperti del settore. Fondata da ex alunni di Google DeepMind, l'azienda ha recentemente presentato un innovativo agente AI, denominato Faraday, che ha conseguito risultati sorprendenti. Questo sistema si è distinto nel complesso compito di replicare ricerche scientifiche, superando in performance colossi affermati come Anthropic, con il suo modello Claude Opus 4.8, e OpenAI, tramite GPT-5.5.
Un successo che riposiziona le aspettative sulle capacità dei modelli di intelligenza artificiale nel campo della ricerca.
L'approccio innovativo di Faraday
Il vero punto di forza di Faraday risiede nel suo approccio innovativo. Nonostante si basi su un modello relativamente contenuto, Qwen 3.6, con soli 27 miliardi di parametri, Inherent ha posto l'accento su un concetto fondamentale: il "research taste". Questo non si limita alla mera precisione nella replica dei risultati, ma implica una profonda e istintiva capacità di discernere e identificare gli esperimenti di maggiore valore scientifico. Tale abilità non è stata acquisita tramite il tradizionale addestramento focalizzato sulla metodologia scientifica, bensì attraverso un sofisticato processo di reinforcement learning, che permette all'AI di apprendere e affinare le proprie scelte in modo autonomo.
La strategia di successo dietro Faraday
La strategia che ha portato al successo di Faraday rivela un comportamento che va oltre la semplice esecuzione di compiti predefiniti. L'agente AI non si limita a replicare esperimenti, ma manifesta un'attitudine da "curioso scienziato", capace di ideare e testare autonomamente nuove ipotesi e configurazioni sperimentali. Sebbene si avvalga di un supporto esterno per le attività di codifica, fornito da OpenAI’s GPT-5.5 Codex, Faraday dimostra un'autonomia significativa nell'esecuzione e nella gestione degli esperimenti scientifici, evidenziando una capacità di problem-solving avanzata e una vera e propria iniziativa di ricerca.
Replica: il framework per la validazione
A supporto della validità delle scelte metodologiche di Inherent, uno studio scientifico ha introdotto un framework teorico e pratico denominato Replica. Questo rappresenta uno spazio di lavoro scalabile, specificamente concepito per la replica di paper scientifici. Replica integra un sistema di giudizio basato su rubriche auto-generate, che garantisce una valutazione accurata e con un basso "rumore", allineando il processo di assessment automatizzato a quello che sarebbe il giudizio umano. Questo meccanismo di validazione è cruciale per assicurare l'affidabilità e la robustezza dei risultati ottenuti da agenti AI come Faraday.
Verso una nuova era di innovazione scientifica
Le implicazioni di questi progressi sono considerevoli e aprono nuove prospettive per il futuro della ricerca scientifica. I miglioramenti qualitativi nell'approccio di Faraday gli hanno permesso di superare le performance di modelli più grandi come Claude Opus e GPT-5.5 nei compiti di replica, adottando una metodologia più principled e scientificamente solida. Questa notevole capacità di apprendere, adattarsi e innovare senza la necessità di complessi framework predefiniti infonde un notevole ottimismo. L'avventura di Inherent con Faraday non rappresenta solo un significativo passo avanti tecnologico, ma prefigura un potenziale cambio di paradigma nel modo in cui l'intelligenza artificiale potrà contribuire attivamente e autonomamente all'innovazione scientifica a lungo termine, aprendo la strada a scoperte future.