24.04.2026
8 min de lecture

Le 22 avril 2026, lors de Cloud Next à Las Vegas, Google a présenté la huitième génération de TPU et, pour la première fois, a séparé matériellement l’entraînement et l’inférence. La TPU 8t relie jusqu’à 9 600 puces pour les charges de travail d’entraînement, tandis que la TPU 8i regroupe 1 152 puces par pod d’inférence avec trois fois plus de SRAM sur puce. Parallèlement, la plate-forme Gemini Enterprise Agent a été lancée. Pour les conseils d’administration des conglomérats allemands, ce n’est pas un détail technologique, mais une nouvelle dimension d’achat qui apparaîtra lors du prochain examen des investissements informatiques.

L’essentiel en bref

  • La capacité d’inférence devient une taille d’achat. La TPU 8i regroupe 1 152 puces par pod, trois fois plus de SRAM que Ironwood, optimisé pour l’exécution parallèle d’agents.
  • L’infrastructure Agentic devient une commodité. La plate-forme Gemini Enterprise Agent en ligne depuis le 22 avril. Accenture, BCG, Mars et Merck comme clients de référence. Le marché s’ouvre plus vite que de nombreux conseils d’administration ne le prévoient.
  • Question du conseil d’administration à partir de maintenant : mise à l’échelle de l’inférence ou risque de fournisseur. Quiconque ne connaît pas la TPU 8i et le protocole A2A ne peut pas donner une garantie fiable de mise à l’échelle de la productivité.

ApparentéGartner IT-Spending 2026 : 6 150 milliards/Managed Services Build vs. Buy 2026

Ce que Sundar Pichai a annoncé concrètement le 22 avril

Le PDG de Google, Sundar Pichai, a présenté trois éléments de produit dans la fenêtre de keynote à 10h00 PST. La huitième génération de TPU est la plus visible, mais pas la plus stratégiquement importante. TPU 8t utilise une nouvelle technologie d’interconnexion inter-puces et relie jusqu’à 9 600 TPU plus deux pétaoctets de mémoire partagée à large bande passante dans un seul superpod. Google parle d’une performance triple par rapport à Ironwood. TPU 8i est le jumeau de l’inférence : 1 152 puces par pod, triple capacité de SRAM sur puce, optimisé pour une faible latence avec des millions de requêtes d’agents parallèles.

Le deuxième élément est la plate-forme Gemini Enterprise Agent. Elle est entrée directement dans la disponibilité générale le 22 avril. Google a indiqué que les revenus de la plate-forme prédécesseur avaient augmenté de 40 % au premier trimestre 2026 avec des utilisateurs actifs mensuels payants. Parallèlement, Accenture et BCG ont annoncé des extensions de partenariat avec le programme d’accélération Gemini Enterprise. Mars utilise la plate-forme pour 150 000 employés. Merck avait déjà annoncé le 22 avril une alliance AI agentic d’un milliard de dollars avec Google Cloud, que nous avons classée ailleurs comme modèle pour les décisions du conseil d’administration.

Le troisième élément, sous-estimé dans les conseils d’administration, est le protocole Agent-to-Agent. Google l’a positionné comme une norme ouverte, OpenAI et Anthropic ont donné des signaux d’interopérabilité. Cela crée un écosystème qui définit la communication entre agents de manière provider-agnostique. Pour la stratégie informatique, cela signifie que les arguments de verrouillage se déplacent du modèle individuel vers la couche d’infrastructure sous-jacente.

1.152
Puce TPU 8i par pod d’inférence, triple capacité de SRAM sur puce par rapport au prédécesseur Ironwood. Objectif : exécuter des millions d’agents concurrents avec une faible latence de manière efficace en termes de coûts.
Source : Google Cloud Next 2026 Keynote, 22.04.2026

Qu’est-ce que TPU 8i ? TPU 8i est la variante d’inférence de la huitième génération de TPU de Google, annoncée le 22 avril 2026 sur Cloud Next. Elle relie 1 152 puces par pod avec une triple capacité de SRAM sur puce par rapport à la génération prédécesseur Ironwood et est explicitement optimisée pour l’exécution parallèle d’agents AI autonomes. La séparation entre l’entraînement (TPU 8t) et l’inférence (TPU 8i) est le signal stratégique : Google traite les deux types de charge de travail comme des produits distincts avec leur propre logique de tarification et de mise à l’échelle.

Trois questions pour le conseil d’administration lors du prochain examen des investissements informatiques

La demande adressée au conseil d’administration n’est pas d’acheter maintenant une feuille de route Google TPU. Elle consiste à connaître les termes avant que la direction informatique ne pose la question du budget. Trois points doivent être abordés lors de la prochaine réunion du conseil d’administration, quelle que soit la préférence de l’entreprise pour les hyperscalers.

Premièrement : la capacité d’inférence comme taille d’achat distincte. Jusqu’à Cloud Next 2026, de nombreuses équipes informatiques ont calculé l’inférence et la formation ensemble. Google les sépare désormais matériellement. AWS avait déjà différencié Trainium 2 et Inferentia 3 l’année dernière. La conséquence stratégique est que les planifications budgétaires doivent comporter deux chiffres et non un. Celui qui confond cela calcule la capacité de pointe comme charge de base et paie le supplément.

Deuxièmement : construire, acheter ou gérer. Le lancement de l’agent Gemini Enterprise raccourcit considérablement le temps de déploiement des agents. La question du conseil d’administration n’est pas de savoir si « nous voulons construire des agents », mais « construisons-nous nous-mêmes, achetons-nous des agents standard ou louons-nous une voie d’agent géré ». La même distinction qui a été clarifiée en 2025 sur le thème des services gérés se répète maintenant au niveau des agents. Le partenariat BCG avec Google montre où le marché pousse : les bundles de plate-forme plus intégration plus gestion du changement seront le package d’achat standard.

Troisièmement : poser à nouveau les questions de souveraineté. Avec TPU 8i, Google devient technologiquement plus difficile à rattraper. Les fournisseurs de cloud européens qui utilisent des puces NVIDIA doivent concurrencer un hyperscaler intégré sur les prix de l’inférence. Ce n’est pas interdit, mais cela change l’équation économique. Pour les conseils d’administration de la région DACH qui ont besoin de garanties de localisation des données, la décision entre les fournisseurs de l’UE et les hyperscalers sera plus dure et non plus douce.

Un conseil d’administration qui n’a pas de position sur la capacité d’inférence et la gouvernance des agents en 2026 prendra la prochaine décision budgétaire informatique à l’aveugle. Google Cloud Next était le signal que le marché définit justement les questions avant que les réponses ne circulent.

Ce que cela signifie concrètement pour les conseils d’administration allemands

Trois réflexes sont utiles dans les semaines à venir. Premièrement : examiner sa propre feuille de route d’agent. Quiconque utilise actuellement des agents pilotes sur une infrastructure LLM générique devrait poser la question de la capacité productive lors de la prochaine réunion de pilotage. Deuxièmement : documenter la situation contractuelle avec les hyperscalers. Quelles options de sortie sont réalistes deux ans après le déploiement si TPU 8i est devenu la norme ? Troisièmement : activer la conformité tôt. La communication agent à agent soulève des questions de responsabilité qui ne sont pas abordées proprement par DORA ou NIS2. Cela sera affiné, mais pas dans ce trimestre.

L’évaluation calme est que Google Cloud Next 2026 n’a pas été le moment qui a basculé le marché. C’était le moment qui a montré que cela bascule. Les conseils d’administration qui prennent leurs décisions d’architecture en 2026 sur la base d’hypothèses de 2024 atterriront en 2027 en mode d’adaptation. La tâche de leadership intéressante consiste à prendre maintenant une position qui sera encore viable dans douze mois.

Foire aux questions

Qu’est-ce que TPU 8i et pourquoi est-elle pertinente pour les conseils d’administration ?

TPU 8i est la huitième génération de TPU d’inférence de Google, annoncée le 22 avril 2026 lors de Cloud Next. Elle regroupe 1 152 puces par pod avec trois fois plus de mémoire SRAM sur puce. Elle est pertinente pour les conseils d’administration car la capacité d’inférence apparaît désormais comme une unité d’achat distincte dans les budgets informatiques.

Qu’est-ce que le protocole Agent-to-Agent ?

Un standard ouvert pour la communication entre agents de différents fournisseurs, présenté par Google lors de Cloud Next. OpenAI et Anthropic ont donné des signaux d’interopérabilité. Résultat : les arguments de verrouillage se déplacent du modèle vers l’infrastructure sous-jacente.

Devons-nous passer à Google maintenant ?

Non. L’annonce ne concerne pas un changement de technologie, mais une vérification du vocabulaire. Les conseils d’administration devraient maîtriser la distinction entre les capacités de formation et d’inférence et prendre position sur la gouvernance des agents. AWS et Azure suivront avec leurs propres réponses.

Quel est le rapport avec la prévision de 6 150 milliards de Gartner ?

La prévision de dépenses informatiques de Gartner pour 2026 voit une proportion importante du marché consacrée à l’IA. Cloud Next 2026 fournit l’infrastructure qui rend cette répartition budgétaire opérationnelle. Les conseils d’administration qui n’ont pas de ligne d’inférence dans leur budget devront la prendre en compte au cours de l’année.

Quelles questions de conformité doivent être clarifiées maintenant ?

La communication Agent-to-Agent crée des scénarios de responsabilité qui ne sont couverts que partiellement par DORA et NIS2. Les conseils d’administration devraient charger leurs équipes juridiques et de conformité de concevoir des clauses contractuelles pour les agents étrangers dans leur système avant que les premiers cas de production ne surviennent.

Source de l’image de titre : Pexels / Brett Sayles (px:5480781)

À lire aussi

Partager cet article :

Aussi disponible en

Plus d'articles

15.08.2026

ChatGPT pourrait espionner les conversations sur le Mac

Eva Mickler

6 min de lecture OpenAI a décrit le 13 août 2026 l’historique informatique pour l’application ...

Lire l’article
14.08.2026

SpaceX rachète Cursor : les clauses de l’UE restent en suspens

Eva Mickler

5 min de lecture L’accord de vente a été finalisé le 14 août 2026. Toute entreprise utilisant cet ...

Lire l’article
13.08.2026

CRA impose aux fabricants de déclarer sous 24 heures

Bernhard Liebl

9 min de lecture Le 11 septembre 2026, l’article 14 du Cyber Resilience Act entrera en vigueur. À ...

Lire l’article
11.08.2026

Les plans de milliards de dollars de NVIDIA et ce que les exploitants doivent désormais examiner

Bernhard Liebl

7 min de lecture NVIDIA a annoncé le 10 août 2026, en collaboration avec six partenaires financiers, ...

Lire l’article
10.08.2026

Le boom des GPU face à l’informatique verte : où les investissements en IA grincent

Eva Mickler

4 min de lecture L’AI-Capex rencontre le reporting durable. Les clusters GPU, le refroidissement et ...

Lire l’article
09.08.2026

Quand le réseau limite et non la carte graphique

Eva Mickler

8 Min. Temps de lecture De nombreuses directions informatiques développent leur capacité GPU et attendent ...

Lire l’article
Un magazine de Evernine Media GmbH