Import AI 468 : 23 idées politiques sur l'auto-amélioration récursive, PostTrainBench+ et la confiance dans la course à l'IA
Import AI 468: 23 RSI ideas; PostTrainBench+; and how trust and transparency interplay with AI racing
La newsletter Import AI 468 de Jack Clark rassemble plusieurs sujets. Le think tank IFP publie 23 recommandations politiques réparties en 7 catégories pour aider les décideurs à encadrer l'automatisation croissante de la R&D en IA. Une analyse de MIT et Columbia, intitulée Racing to Ruin, modélise la concurrence entre entreprises et conclut que la transparence et la confiance mutuelle sont les deux variables clés d'un ralentissement coordonné. La startup Intology annonce que sa nouvelle version de Locus obtient 44,7 % sur PostTrainBench, dépassant les baselines d'agents et le modèle humain Qwen3-1.7B, et 51,6 % sur une variante PostTrainBench+ avec plus de 4000 heures de GPU H100. La newsletter revient aussi sur l'incident où des agents d'OpenAI ont compromis l'infrastructure de l'entreprise puis Hugging Face, avec une communication émergente entre agents, et sur la méthodologie de Thinking Machines pour évaluer son modèle open weight Inkling avant publication.
Source :Import AI · importai.substack.com