Notre décision concernant Cursor suite à son acquisition par SpaceX ↗
OpenAI annonce la fin de son accord de fourniture de modèles à Cursor suite au rachat de la plateforme de programmation par SpaceX. L'entreprise explique ne plus pouvoir garantir que SpaceX utilisera sa technologie conformément aux conditions d'OpenAI.
OpenAI annonce également qu'elle ne fournira plus de modèles à Cursor. C'est une rupture importante, notamment pour les développeurs qui considèrent l'utilisation de Cursor et des modèles OpenAI comme une solution de programmation quasi standard. (OpenAI)
Tencent, la société chinoise, publie un nouveau modèle d'IA open source pour le codage et les tâches de recherche ↗
Tencent a publié un aperçu de Hy4, un modèle open source destiné au génie logiciel, à la recherche et à l'analyse financière. Il utilise une architecture de type « mix-of-experts » avec un total de 770 milliards de paramètres, dont environ 49 milliards sont activés pour chaque requête textuelle.
Tencent prévoit de l'intégrer à des produits comme CodeBuddy et WorkBuddy. L'entreprise reconnaît que la version préliminaire peut parfois s'attarder inutilement sur des questions complexes et se vérifier avec un enthousiasme excessif… mais elle a son charme. (Reuters)
Les chercheurs automatisés peuvent atténuer de manière fiable les erreurs d'alignement ↗
Anthropic a montré Claude effectuant des recherches de manière autonome, proposant des techniques de formation, menant des expériences et améliorant des modèles dans 10 catégories d'échec d'alignement, y compris la tromperie, les jailbreaks et la flagornerie.
Ses méthodes les plus performantes ont amélioré tous les indicateurs de performance ciblés sans dégrader les capacités mesurées par Anthropic, et certaines se sont avérées transposables à des modèles jusqu'à 4,7 fois plus grands. Le système de recherche automatisé de Claude a également surpassé les propositions de chercheurs expérimentés en sécurité humaine dans le cadre de cette étude.
Il y a un hic, bien sûr. Anthropic a détecté des comportements de tricherie dans une petite partie des exécutions de recherche automatisées et souligne que ses tests de performance ne couvrent qu'une infime partie des conditions d'alignement pratiques. Donc… de la recherche en IA auto-améliorante, avec une IA qui surveille le chercheur en IA. Rien d'extraordinaire. (Anthropic)
Anthropic a été illégalement mise sur liste noire par l'administration Trump, selon une décision de justice ↗
Un juge fédéral a statué que la décision du Pentagone de placer Anthropic sur liste noire en tant que risque pour la chaîne d'approvisionnement était inconstitutionnelle, qualifiant cette action de représailles illégales et jugeant la désignation arbitraire et capricieuse.
Le conflit a débuté lorsque Anthropic a refusé de lever les restrictions interdisant l'utilisation de son IA pour la surveillance de masse des Américains ou pour des armes autonomes létales sans supervision humaine. Cette décision constitue une victoire importante pour Anthropic et un précédent significatif dans le débat sur la possibilité pour les gouvernements de sanctionner les fournisseurs d'IA qui définissent leurs propres limites de sécurité. (The Verge)
Le fonds de l'ère des machines ↗
Andreessen Horowitz a levé 1,1 milliard de dollars pour un nouveau fonds Machine Age axé sur l'infrastructure physique sous-jacente à l'IA : puces, mémoire, réseaux, stockage, centres de données, robotique et même matériel d'IA domestique.
L'idée principale est que le prochain goulot d'étranglement de l'IA ne réside pas dans une nouvelle fonctionnalité sophistiquée de chatbot, mais dans les contraintes physiques. La consommation d'énergie, le refroidissement, la bande passante mémoire et le réseau doivent tous évoluer à une vitesse fulgurante, et l'a16z ambitionne de jouer un rôle déterminant dans le développement de ces composants matériels. (Andreessen Horowitz)
Google enfouit davantage les résultats de recherche sous le mode IA ↗
Google a commencé à développer automatiquement les aperçus fournis par l'IA pour certaines recherches. Au lieu d'un bref résumé suivi rapidement de liens classiques, les utilisateurs peuvent obtenir une réponse complète de l'IA, un encadré « Posez vos questions », puis les résultats web habituels.
Google affirme que cette expérience enrichie s'affiche lorsque ses systèmes estiment qu'elle sera particulièrement utile. Pour les éditeurs, cependant, le problème est évident : les liens classiques sont relégués encore plus bas sur la page, tandis que l'IA de Google devient de plus en plus difficile à contourner. (The Verge)
FAQ
Pourquoi OpenAI met-elle fin à son accord de modélisation avec Cursor après l'acquisition par SpaceX ?
OpenAI annonce son intention de limiter l'accès à ses modèles pour Cursor, car elle ne peut plus être certaine que SpaceX utilisera sa technologie conformément aux conditions d'utilisation d'OpenAI. L'entreprise précise également que les futurs modèles OpenAI ne seront plus fournis à Cursor. Pour les développeurs, cela pourrait bouleverser leur flux de travail habituel, qui associait Cursor aux modèles OpenAI.
Qu'est-ce que Tencent Hy4 et à quoi est-il destiné ?
Tencent Hy4 est un modèle d'IA open source conçu pour le génie logiciel, la recherche et l'analyse financière. La version préliminaire utilise une architecture de type « mixing-of-experts » avec un total de 770 milliards de paramètres, dont environ 49 milliards sont activés pour chaque requête textuelle. Tencent prévoit d'intégrer Hy4 à des produits tels que CodeBuddy et WorkBuddy, tout en reconnaissant que la version préliminaire peut parfois suranalyser et survérifier les questions complexes.
Les chercheurs en IA peuvent-ils améliorer automatiquement l'alignement des modèles ?
Les recherches d'Anthropic suggèrent que les chercheurs en IA automatisée peuvent identifier et tester des techniques pour réduire plusieurs types d'erreurs d'alignement. Claude a été utilisé pour explorer les recherches existantes, proposer des approches d'entraînement, mener des expériences et évaluer les améliorations dans des domaines tels que la tromperie, le jailbreak et la flagornerie. Anthropic a également constaté que certaines techniques efficaces étaient transposables à des modèles plus grands, bien que l'étude ne porte que sur un nombre limité de conditions d'alignement pratiques.
Pourquoi un tribunal a-t-il statué qu'Anthropic était illégalement mise sur liste noire ?
Un juge fédéral a statué que la désignation d'Anthropic comme risque pour la chaîne d'approvisionnement par le Pentagone était inconstitutionnelle, arbitraire et abusive. Ce litige faisait suite au refus d'Anthropic de lever les restrictions relatives à la surveillance de masse des citoyens américains et aux armes autonomes létales sans contrôle humain. Cette décision pourrait constituer un arrêt de principe important dans les futurs litiges portant sur la possibilité pour les gouvernements de sanctionner les entreprises d'intelligence artificielle qui maintiennent leurs propres restrictions de sécurité.
Pourquoi a16z investit-il 1,1 milliard de dollars dans l'infrastructure d'IA ?
Andreessen Horowitz a créé son fonds Machine Age de 1,1 milliard de dollars pour investir dans les systèmes physiques nécessaires au déploiement à grande échelle de l'intelligence artificielle. Ce fonds se concentre notamment sur les puces, la mémoire, les réseaux, le stockage, les centres de données, la robotique et les dispositifs d'IA domestique. Il reflète une tendance plus générale dans le domaine de l'IA : les progrès futurs pourraient dépendre autant de la consommation énergétique, du refroidissement, de la bande passante et de l'infrastructure informatique que des améliorations apportées aux modèles logiciels.
Comment les aperçus de l'IA de Google transforment-ils les résultats de recherche traditionnels ?
Google étend automatiquement les aperçus générés par l'IA pour certaines recherches, en affichant une réponse plus complète et une interface « Poser une question » avant les résultats de recherche classiques. Par conséquent, les liens ordinaires peuvent apparaître plus bas sur la page. Pour les éditeurs et les équipes SEO qui suivent l'actualité de l'IA, ce changement soulève des questions pratiques concernant la visibilité dans les résultats de recherche, le trafic de référence et la manière dont les utilisateurs découvrent les sources originales.