RSS Amplifier

GPToast · Aug 26, 2026

🌶️ La puce d'OpenAI devance Blackwell

0
Sign in to vote or save

GPToast · GPToast

Voici votre toast du jour.

Dans l’édition de ce matin :

  • La première puce d’OpenAI devance Nvidia sur un benchmark d’inférence

  • L’EPA veut supprimer l’avis aux riverains pour les data centers polluants

  • La SEC enquête sur le fonds IA de Leopold Aschenbrenner

The Toast : un filigrane Microsoft qui contient votre identifiant, 200 millions de plus pour un cerveau de robot, Claude qui s’invite dans vos canaux Slack sans qu’on l’appelle, et 13 000 humanoïdes livrés l’an dernier dont neuf sur dix sortent de Chine.

À transférer : La première puce d’OpenAI, conçue avec Broadcom, passe devant Nvidia Blackwell sur un benchmark d’inférence.

Partager

GPToast - OpenAI’s Jalapeño chip
© TechCrunch

Elle s’appelle Jalapeño, elle n’existera qu’en très petite série cette année, et elle vient de passer devant le matériel le plus convoité du secteur.

Pourquoi on en parle ? À la conférence Hot Chips, ce mardi 25 août, OpenAI a présenté les premiers résultats de Jalapeño, sa puce d’inférence conçue avec Broadcom. Sur le benchmark InferenceX de Semianalysis, elle affiche davantage de tokens par utilisateur et un meilleur débit par kilowatt que le système Blackwell de Nvidia.

Rappel : l’inférence est le calcul qui se déclenche à chaque requête, celui qui rédige la réponse, à ne pas confondre avec l’entraînement du modèle. C’est la partie qui se répète des milliards de fois par jour et qui décide de la facture d’électricité. Broadcom, de son côté, est le sous-traitant américain qui conçoit des puces sur mesure pour les entreprises qui ne veulent plus acheter celles des autres.

Dans les faits : Jalapeño avait été annoncée en octobre 2025. Richard Ho, responsable du matériel chez OpenAI, résume les mesures ainsi : « au fond, les résultats montrent une avance de performance très, très significative sur l’état de l’art ». La conception cherche à réduire les déplacements de données pendant la phase de préparation de la requête et pendant les échanges entre puces, en gardant l’état du modèle et le cache au plus près du calcul. Premiers déploiements fin 2026 en « très petits volumes », montée en charge attendue en 2027.

Ce que ça change : Chaque token servi sur du silicium maison est un token qui ne passe pas par une facture Nvidia. Pour OpenAI, dont l’inférence constitue le poste de coût principal, un meilleur débit par kilowatt se lit directement sur la marge et sur le nombre de clients qu’un même data center peut absorber. Pour les concurrents, la question devient : combien de temps rester locataire de son fournisseur pendant que le voisin devient propriétaire.

Un peu de recul. Un benchmark n’est pas une chaîne de production. OpenAI parle de très petits volumes fin 2026 et renvoie l’essentiel du déploiement à 2027 : d’ici là, ses salles serveurs restent remplies de matériel acheté ailleurs. L’entreprise indique aussi avoir utilisé ses propres modèles pour concevoir la puce, ce qui rend la démonstration plus intéressante que sa fiche technique.

Bref. Le plus gros acheteur de puces IA de la planète vient de montrer qu’il savait aussi en faire.

À qui l’envoyer : DSI et responsables infrastructure, investisseurs semi-conducteurs, ingénieurs machine learning, dirigeants qui négocient une facture cloud.

À copier-coller : La première puce d’OpenAI passe devant Nvidia Blackwell sur un benchmark d’inférence. Livraisons fin 2026.

Un groupe électrogène s’installe au bout de la rue. Bientôt, plus personne ne sera obligé de vous prévenir.

Dans les faits : L’agence américaine de protection de l’environnement propose de retirer l’obligation fédérale d’information et de consultation du public pour les permis d’émission dits « source mineure », prévus par le Clean Air Act. Chaque État et chaque collectivité déciderait ensuite s’il avertit ou non les habitants de l’arrivée d’une nouvelle source de pollution.

Pourquoi ça compte ? L’Environmental Protection Network, un collectif d’anciens agents de l’EPA, prévient que les gros générateurs à énergie fossile installés pour alimenter les data centers IA pourraient être rangés dans la catégorie « mineure », et échapper ainsi à l’examen renforcé réservé aux grandes sources. Mike Koerber, ancien directeur adjoint de l’agence, y voit une continuité : « en supprimant l’obligation fédérale de longue date d’information du public, cette proposition poursuit les efforts de l’administration actuelle pour tourner le dos au principe fondamental de transparence de l’EPA ». Plus de 70 % des Américains déclarent ne pas vouloir de data center dans leur voisinage.

Bref. La proposition contredit la note de transparence signée par Lee Zeldin, l’administrateur de l’EPA lui-même, qui réclamait la plus large participation possible du public.

À qui l’envoyer : équipes RSE et affaires publiques, élus locaux, responsables immobilier et énergie, voisins d’un projet de data center.

À copier-coller : L’EPA propose de supprimer l’obligation fédérale de prévenir les riverains avant un nouveau data center polluant.

Un ancien d’OpenAI parie tout sur l’IA, l’IA recule, et le gendarme boursier commence à poser des questions aux banques.

Dans les faits : Selon le New York Times, dont TechCrunch reprend l’information, la SEC a envoyé des assignations aux banques qui travaillaient avec le fonds Situational Awareness, celles qui supervisaient ses opérations de marché comme celles qui le finançaient. Les régulateurs leur ont demandé de conserver toute information concernant le fonds.

Pourquoi ça compte ? Situational Awareness, dirigé par Leopold Aschenbrenner, ancien d’OpenAI, avait grossi très vite grâce à une stratégie concentrée sur les valeurs IA. Fin juillet 2026, le repli des actions du secteur lui a fait perdre des milliards. Aucune faute ne lui est reprochée à ce stade, et le fonds indique qu’il coopérera pleinement avec toute demande du régulateur. L’épisode donne une idée du degré de concentration que des acteurs financiers sérieux acceptent aujourd’hui sur un seul thème.

Bref. Miser sur une seule idée fonctionne parfaitement, jusqu’au trimestre où cette idée baisse.

À qui l’envoyer : investisseurs et gérants, directions financières, fondateurs qui lèvent sur le thème IA, journalistes marchés.

À copier-coller : La SEC a assigné les banques du fonds IA de Leopold Aschenbrenner après ses pertes de fin juillet.

Vous êtes plus de 5 000 à nous lire chaque matin et la plupart d’entre vous êtes là grâce au bouche-à-oreille, alors un grand merci de parler de nous 🫶

Pour nous soutenir, vous pouvez partager votre lien de parrainage à vos collègues, votre groupe de promo ou de famille :) Et pour rappel, plus vous avez de parrainages, plus vous gagnez de cadeaux - à découvrir dans le dashboard, où vous pourrez suivre votre avancée.

Dès deux parrainages, on vous envoie votre premier cadeau et on va même jusqu’à vous offrir 2 mois d’abonnement à votre IA préférée.

Obtenez votre lien à partager ici

Merci pour votre soutien :)

🔹 Wan 3.0 — Le modèle vidéo d’Alibaba passe en version officielle et génère jusqu’à 30 secondes de vidéo 1080p avec le son en une seule passe, à partir d’un texte comme d’un PDF ou d’une présentation : pour les créateurs qui veulent des séquences longues sans les recoller.

🔹 Antigravity — L’outil de développement agentique de Google se pilote maintenant à distance depuis n’importe quel navigateur ou votre mobile : pratique si vous lancez des tâches d’agent qui durent et ne voulez plus rester scotché à votre bureau.

🔹 Firefly Audio — Adobe ouvre à tous ses générateurs de musique, de voix off et d’effets sonores « commercialement sûrs » : la réponse évidente pour les créateurs vidéo qui redoutent une revendication de droits d’auteur.

🔹 Apodex 1.1 — Une famille de modèles en poids ouverts (dont une version 35B qui tourne en local) qui découpe une tâche complexe et coordonne plusieurs agents en parallèle : réservé aux profils techniques, mais impressionnant.

🖼️ Le filigrane invisible de Microsoft contient un identifiant unique — Xusheng Li, développeur chez Vector 35, a examiné les images générées par l’IA dans Paint et Photos, et a trouvé un GUID, un identifiant unique, encodé dans les pixels. Le mécanisme tient en trois temps : votre requête part chez Microsoft pour modération, le serveur renvoie un identifiant, l’application l’inscrit dans l’image produite sur votre machine. Deux créations successives peuvent ainsi être reliées entre elles. Microsoft communique publiquement sur sa conformité au standard C2PA, qui sert à tracer l’origine d’un contenu, mais Li lui reproche de ne pas dire clairement que ce marquage contient un identifiant lié à la requête. Si l’entreprise conserve le lien entre requêtes et comptes, le filigrane devient un chemin vers l’auteur, comme les points jaunes que les imprimantes laser déposaient discrètement sur chaque page.

🤖 200 millions de dollars de plus pour un cerveau de robot — Generalist, qui construit des modèles d’IA pour robots et non des robots, a levé environ 200 millions de dollars menés par le fonds 8VC, deux mois après un tour de 400 millions qui la valorisait 2 milliards en juin 2026. La nouvelle valorisation dépasse ces 2 milliards, sans chiffre communiqué : l’opération a été repérée dans un dépôt auprès de la SEC, pas dans un communiqué de presse. Fondée par des anciens de Google DeepMind et de Boston Dynamics, l’entreprise travaille sur la dextérité, c’est-à-dire la capacité d’une machine à manipuler des objets sans les abîmer. Nvidia, Bezos Expeditions, Spark Capital et la chercheuse Fei-Fei Li figurent parmi ses investisseurs.

💬 Claude s’invite dans vos canaux Slack sans qu’on l’appelle — Anthropic a mis à jour Claude Tag, son agent Slack : au lieu d’examiner chaque message isolément, il lit désormais le fil entier du canal, ce qui le rend environ 30 % meilleur pour décider s’il doit intervenir. Quatre issues s’offrent à lui, répondre dans le canal, ouvrir un fil, rattacher le sujet à un chantier existant, ou se taire, et l’entreprise assume la dernière : « un agent agaçant est pire qu’un agent inutile ». Côté accès, l’agent ne voit que l’intersection la plus restrictive entre ses propres droits et ceux de l’utilisateur, et le contexte d’un canal ne se déverse pas dans un autre. Scott White, responsable des produits entreprise, précise que ce contexte élargi ne compte pas dans les limites d’usage, sans s’engager sur la durée.

🦾 À Shanghai, un carnaval de robots humanoïdes — MIT Technology Review raconte l’événement public où la Chine exhibe ses humanoïdes, démonstrations d’arts martiaux comprises. Le chiffre à retenir est ailleurs : sur les 13 000 robots à deux bras et deux jambes livrés dans le monde l’an dernier, 90 % sortaient d’usines chinoises. La même lettre signale que l’action du fabricant Unitree a perdu 45 % après son introduction en Bourse, ce qui refroidit une partie de la salle. Le pays produit donc la quasi-totalité des humanoïdes de la planète, et ses propres investisseurs commencent déjà à trouver le ticket cher.

Pourquoi c’est utile : Chaque fois que vous demandez un visuel à une IA, vous repartez de zéro et le résultat ne ressemble jamais vraiment à votre marque. Ici, vous extrayez une fois pour toutes vos règles visuelles, et tous vos prochains visuels générés restent cohérents.

Comment faire :

  1. Téléchargez et installez Open Design sur votre ordinateur (outil gratuit et open source). C’est une application locale : elle s’installe chez vous et vos fichiers restent sur votre machine.

  2. Connectez un agent IA que vous utilisez déjà, par exemple Codex CLI (l’agent d’OpenAI qui s’utilise depuis le terminal, l’application qui permet de taper des commandes à votre ordinateur). Open Design détecte automatiquement les agents installés sur votre machine et vous laisse en choisir un : c’est lui qui générera les designs.

  3. Dans l’application, cliquez sur « Create New Design System » (créer un nouveau système de design), collez l’adresse de votre site web, cliquez sur « Add », puis sur « Continue ». L’outil analyse votre site et en extrait vos règles visuelles.

  4. Regardez ce qui a été extrait. S’il manque quelque chose, ajoutez votre logo, des images, ou un fichier DESIGN.md (un simple fichier texte qui décrit vos règles de marque : couleurs, typographies, styles).

  5. Sélectionnez le système de design que vous venez de créer, puis donnez une consigne concrète et précise (voir le bloc Prompt).

  6. Pour obtenir une v2, donnez votre retour en langage naturel, exactement comme vous le feriez avec ChatGPT. Vous pouvez aussi annoter directement le design ou entourer les éléments que vous voulez modifier.

Prompt : « Créez une animation de 10 secondes qui explique notre produit. »

Option : Cadrez d’abord l’idée et la formulation de votre consigne dans ChatGPT, puis construisez le visuel dans l’espace de travail d’Open Design, proche de Figma.

Temps : 30 min la première fois (installation et extraction), puis quelques minutes par visuel.

> Cet email vous a été transféré ? Abonnez-vous ici

Antoine & Tom, les humains derrière GPToast

Read the original on gptoast.substack.com

Comments

Nothing yet. Say the first thing.

    Sign in to join the conversation.