Actualités IA 25 août 2026

Résumé et quiz sur l'IA : 25 août 2026

Les premiers résultats de Jalapeño démontrent une vitesse et une efficacité inégalées dans le domaine de l'inférence par IA

OpenAI a publié les premiers résultats de performance de Jalapeño, sa puce d'inférence personnalisée. Sur GPT-OSS 120B, la puce affiche un débit de pointe par kilowatt environ 1,9 fois supérieur et une latence de bout en bout environ 1,7 fois inférieure à celle du système de référence.

Ces améliorations se sont également répercutées sur DeepSeek R1 et Kimi K2.5. OpenAI prévoit de déployer Jalapeño au sein de sa propre infrastructure de calcul, tandis que les conceptions de deuxième et troisième génération sont déjà en cours… alors oui, OpenAI devient de plus en plus une entreprise de semi-conducteurs, en quelque sorte. (OpenAI)

Claude Cowork se souvient enfin de ce que vous avez dit à l'application dans le chat

Anthropic a unifié la mémoire de Claude, initialement répartie entre les conversations classiques et l'espace de coworking. Les informations recueillies lors des échanges peuvent désormais être utilisées dans les tâches opérationnelles, ce qui évite la corvée de devoir expliquer sans cesse le même projet. 

Les utilisateurs peuvent consulter, modifier et supprimer les sujets mémorisés, et les souvenirs se mettent à jour en temps réel pendant les conversations. Cette fonctionnalité est activée par défaut dans les abonnements Gratuit, Pro et Max. (TechCrunch)

Google Cloud lance Gemini Enterprise pour les services juridiques

Google Cloud a dévoilé Gemini Enterprise, un package spécialement conçu pour les avocats, qui permet à ses agents d'aller au-delà du simple chat et d'accéder à la révision de contrats, à la recherche juridique, à la surveillance réglementaire, aux demandes de confidentialité et à la rédaction de documents.

Il inclut des connecteurs pour des plateformes telles que Harvey, iManage, DocuSign, RelativityOne et Thomson Reuters, tout en préservant les contrôles d'accès et les barrières éthiques existants des entreprises. L'emprise des agents IA a atteint les services juridiques… comme on pouvait s'y attendre, mais à une vitesse impressionnante. (Google Cloud Press Corner)

Google Cloud lance Gemini Enterprise pour les services financiers

Google a également lancé une offre Gemini Enterprise dédiée à la finance, comprenant un agent de recherche financière géré, plus de 50 compétences spécialisées et 13 connecteurs vers des systèmes de données financières et de marché.

La plateforme cible des flux de travail tels que l'évaluation du risque de crédit, le suivi de portefeuille, la recherche KYC et l'analyse de marché. CME Group et Deutsche Bank figurent parmi les organisations déjà impliquées ; les agents d'entreprise se spécialisent de plus en plus, presque comme des logiciels en costume. (Google Cloud Press Corner)

NVIDIA annonce le Jetson Orin Nano 2, un ordinateur robotique qui redéfinit l'IA embarquée d'entrée de gamme

Nvidia a présenté Jetson Orin Nano 2, un ordinateur compact destiné aux robots, aux drones et autres systèmes d'IA physique. Il offre 78 000 milliards d'opérations par seconde, 8 Go de mémoire et un processeur Arm à huit cœurs. 

Nvidia affirme que les performances d'inférence doublent par rapport à la précédente Nano Super, tout en consommant 40 % d'énergie en moins. Le plus intéressant, c'est que des modèles plus petits deviennent réellement performants sur du matériel compact : l'IA n'a plus besoin de solliciter systématiquement les immenses centres de données. (Salle de presse NVIDIA)

Perplexity s'associe à Nvidia pour lancer Portable Computer, un agent d'IA entièrement local et sans frais de jeton

Perplexity a lancé Portable Computer, offrant ainsi son expérience d'ordinateur agentique sur du matériel local équipé de cartes graphiques Nvidia. Les modèles, les fichiers et l'exécution des agents restent sur la machine de l'utilisateur, et les tâches effectuées localement ne consomment aucun crédit de facturation cloud.

Les tâches débutent en local, et le système demande l'autorisation avant de passer à un modèle de cloud de pointe. Il est compatible avec les systèmes Nvidia DGX Spark et Linux dotés de GPU RTX suffisamment puissants ; la confidentialité et le coût deviennent alors des arguments de vente pour l'IA locale, au-delà de la simple vitesse. (Venturebeat)

Anthropic devrait annoncer à ses investisseurs un potentiel de revenus de plus de 30 000 milliards de dollars, rapporte le Wall Street Journal

Anthropic s'apprêterait à annoncer à ses investisseurs que son marché potentiel pourrait dépasser les 30 000 milliards de dollars. Précision importante : il s'agit du chiffre d'affaires annuel théorique si l'IA captait la totalité des tâches, et non d'une prévision d'Anthropic quant à un chiffre d'affaires futur de 30 000 milliards de dollars. (Reuters)

Ce chiffre colossal permet de mieux comprendre les dépenses d'infrastructure d'Anthropic, sa concurrence avec OpenAI et Google, et plus généralement le contexte pour les investisseurs. C'est un nombre exceptionnellement élevé… même pour le secteur de l'IA. (Reuters)

FAQ

Que signifient les résultats de la puce Jalapeño d'OpenAI pour l'inférence en IA ?

OpenAI affirme que Jalapeño a offert un débit de pointe par kilowatt supérieur et une latence de bout en bout inférieure à celle de son système de comparaison lors de l'exécution de GPT-OSS 120B. Des gains similaires ont été observés avec DeepSeek R1 et Kimi K2.5. Ces résultats suggèrent qu'OpenAI conçoit de plus en plus son matériel en fonction des exigences spécifiques d'efficacité et de vitesse de l'inférence IA à grande échelle.

Comment fonctionne la mémoire partagée de Claude entre le chat et Cowork ?

Claude peut désormais intégrer les informations recueillies lors des conversations habituelles dans ses tâches Cowork, évitant ainsi de devoir expliquer plusieurs fois le même projet ou contexte. Les utilisateurs peuvent consulter, modifier et supprimer les sujets mémorisés, et ces derniers sont mis à jour en continu au fil des conversations. D'après l'annonce mentionnée dans l'article, cette fonctionnalité est activée par défaut pour les abonnements Free, Pro et Max.

Que peut faire Gemini Enterprise pour les services juridiques et financiers ?

Les offres spécialisées Gemini Enterprise de Google Cloud sont conçues pour des flux de travail spécifiques à un secteur d'activité, et non pour des échanges IA génériques. La version juridique couvre des domaines tels que la revue de contrats, la recherche, la veille réglementaire, les demandes de confidentialité et la rédaction, tandis que la version pour les services financiers prend en charge des flux de travail incluant l'évaluation du risque de crédit, le suivi de portefeuille, la recherche KYC et l'analyse de marché. Les deux versions peuvent également se connecter aux systèmes de données et logiciels professionnels existants.

Pourquoi l'inférence IA locale devient-elle plus importante ?

L'inférence IA locale peut renforcer la confidentialité, réduire la dépendance à l'infrastructure cloud et potentiellement diminuer les coûts d'utilisation. Le Jetson Orin Nano 2 de Nvidia cible les robots, les drones et autres systèmes périphériques, tandis que l'ordinateur portable de Perplexity conserve les modèles, les fichiers et l'exécution des agents sur du matériel local compatible. Dans de nombreux flux de travail, les modèles cloud peuvent ainsi être réservés aux tâches nécessitant des capacités supplémentaires.

Comment l'ordinateur portable Perplexity décide-t-il quand utiliser l'IA dans le cloud ?

Les tâches sont conçues pour démarrer sur le matériel local de l'utilisateur équipé d'une carte graphique Nvidia, en conservant sur la machine l'exécution des modèles et les fichiers compatibles. Si une étape nécessite un modèle hébergé dans le cloud, le système demande l'autorisation de l'utilisateur avant de l'exécuter. Le travail effectué localement ne consomme pas de crédits de facturation cloud, ce qui rend cette approche pertinente pour les utilisateurs soucieux de la confidentialité et des coûts d'inférence récurrents.

Que signifie l'estimation de 30 000 milliards de dollars du marché de l'IA rapportée par Anthropic ?

Le chiffre mentionné correspond à l'estimation par Anthropic du marché potentiel total de l'IA, et non à une prévision selon laquelle Anthropic générerait 30 000 milliards de dollars de revenus annuels. Il représente la valeur théorique du travail que l'IA pourrait potentiellement accomplir dans l'ensemble de l'économie. Cette estimation permet également de comprendre pourquoi les entreprises leaders en IA investissent autant dans les infrastructures et les capacités d'entreprise.

Actualités IA d'hier : 24 août 2026

Découvrez les dernières fonctionnalités d'IA sur la boutique officielle des assistants IA

À propos de nous

Quiz sur l'actualité et les développements du secteur de l'IA
1. Quels gains de performance OpenAI a-t-il rapportés pour sa puce d'inférence Jalapeño personnalisée exécutant GPT-OSS 120B ?

2. Comment Anthropic a-t-il mis à jour la fonctionnalité de mémoire de Claude dans les conversations régulières et sur Cowork ?

3. Quelles sont les principales spécifications et les points forts en matière de performances du Jetson Orin Nano 2 de NVIDIA ?

4. Comment l'ordinateur portable de Perplexity gère-t-il l'exécution hybride locale et dans le cloud ?

5. Que signifie réellement le chiffre de 30 billions de dollars avancé par Anthropic ?


Retour au blog