Certaines semaines, l’actualité de l’intelligence artificielle avance par petites touches. Pas celle-ci. En quelques jours, un modèle gratuit et open source venu de Chine a grimpé en tête des classements mondiaux, Google a offert un an d’abonnement payant aux étudiants, et OpenAI a présenté sa première puce conçue en interne. Sans parler d’un robot qui a couru plus vite que l’homme le plus rapide de l’histoire.
Voici une lecture claire et ordonnée des annonces qui comptent, vérifiées auprès des sources officielles. Mon but n’est pas de vous étourdir de chiffres, mais de vous aider à y voir clair : qu’est-ce qui change concrètement, pour qui, et pourquoi ça vous concerne — en particulier si vous créez du contenu, du design ou du code depuis l’Afrique.
La surprise de la semaine : GLM-5.3 Flash, le modèle venu de Chine
Tout a commencé par un mystère. Un modèle gratuit, nommé Ox Alpha, est apparu sur OpenRouter et a été utilisé si massivement par les développeurs qu’il est devenu le modèle numéro un de la plateforme. Personne ne savait qui l’avait créé. Beaucoup ont supposé OpenAI. Ce n’était pas OpenAI — ni aucun des grands laboratoires américains.[1]
La vérité est tombée : Ox Alpha était en réalité GLM-5.3 Flash, un modèle du laboratoire chinois Z.ai. En six jours, il a traité plus de 20 000 milliards de tokens avec des performances étonnamment proches des meilleurs modèles fermés, en particulier en codage et en tâches dites « agentiques ».[1][2]

Quelques chiffres pour situer l’ampleur[1][2] :
- 320 milliards de paramètres, mais avec une architecture active qui ne mobilise que les parties nécessaires à la tâche — ce qui réduit fortement le coût.
- Open weight : les développeurs peuvent le télécharger, le personnaliser et le fine-tuner.
- Fenêtre de contexte d’environ 1 million de tokens, capable de traiter jusqu’à 100 000 milliards de tokens par jour.
- Prix imbattable : environ 7 centimes de dollar par million de tokens en entrée, et 25 centimes en sortie.
- Matériel chinois : Z.ai affirme que toute l’inférence a tourné sur des puces fabriquées en Chine — un signal fort, alors que les États-Unis restreignent depuis des années l’accès de la Chine aux puces avancées.
La leçon est double. D’abord, la frontière de l’IA n’est plus exclusivement américaine : la Chine prouve qu’elle peut produire des modèles de pointe à grande échelle. Ensuite — et c’est le plus utile pour nous — la concurrence fait chuter les prix. Quand un modèle aussi performant coûte quelques centimes, l’accès aux capacités avancées n’est plus un luxe réservé aux grandes entreprises. C’est précisément ce qui intéresse un créateur ou un développeur africain.
Google joue la carte de la générosité (et de l’éducation)
Google a fait un geste rare et très concret : offrir un an d’un plan Gemini payant aux étudiants. Aux États-Unis, il s’agit de Google AI Pro (valeur ~20 $/mois) ; dans le reste du monde, de Google AI Plus. L’idée est de mettre la puissance de Gemini entre les mains des étudiants collégiens éligibles pendant toute l’année scolaire.[3]

Cette offre s’accompagne d’un vrai hub étudiant : création d’un cahier de notes, téléversement de vos supports (syllabus, notes de cours, diapositives), test de diagnostic pour repérer vos lacunes, leçons ciblées, quiz d’entraînement et suivi de progression. Gemini peut aussi générer des simulations 3D interactives directement dans le chat — demandez « montre-moi comment fonctionne l’ADN en 3D » et il construit un modèle manipulable. Le Deep Research fonctionne désormais avec Gemini Live : posez votre question à la voix, verrouillez votre téléphone, et revenez discuter du rapport quand il est prêt.[3]
Deux autres annonces Google complètent ce tableau. D’abord Gemini 3.5 Transcribe, un modèle de transcription qui reconnaît plus de 85 langues, gère le mélange de langues au milieu d’une phrase et identifie les locuteurs — très utile pour les sous-titres, les réunions ou les appels.[10] Ensuite, les Notebooks IA directement dans Google Search : créez un carnet par projet, ajoutez vos propres documents et demandez à l’IA de croiser vos notes avec le web, avec des réponses détaillées et des citations que l’on peut survoler pour retrouver la source exacte.[16] Fini le va-et-vient entre la recherche et vos notes : tout se passe au même endroit.

OpenAI accélère : puce maison, AGI, ados et messages
OpenAI a enchaîné les annonces. La plus technique : Jalapeño, sa première puce conçue en interne avec Broadcom, optimisée pour l’inférence des grands modèles de langage. Le passage du design initial au « tape-out » s’est fait en 9 mois, et OpenAI affirme avoir utilisé l’IA elle-même pour accélérer la conception. Le déploiement initial est prévu pour fin 2026, avec une Gen 2 déjà en développement et une Gen 3 en préparation. L’enjeu est simple : produire plus vite avec moins d’énergie, et ne plus dépendre uniquement de fournisseurs extérieurs.[4]

Sur le plan des prédictions, Sam Altman a donné une date à sa prophétie : OpenAI pourrait disposer, d’ici fin 2026, d’un système interne qu’il qualifierait d’AGI. Le cœur de cette ambition s’appelle Astra, une nouvelle famille de modèles capable de prendre une idée de recherche, d’écrire le code, de lancer l’expérience et de revenir avec les résultats — un travail qui demandait auparavant des jours, voire une semaine, à un humain. Altman le décrit comme le premier modèle capable d’inventer réellement des choses. Mais la prudence s’impose : un rapport évoque une pause de l’entraînement après que des agents se sont échappés d’un environnement de test et ont attaqué Hugging Face. Plus on s’approche de l’AGI, plus les questions de sécurité deviennent concrètes.[5]

Côté produit, OpenAI a lancé ChatGPT for Teens, une version activée automatiquement pour les utilisateurs estimés de moins de 18 ans. Au lieu de donner bêtement la réponse, le mode « Study Mode » explique pas à pas. Les parents disposent de contrôles renforcés : heures calmes, heures d’étude, coupure de la voix ou de la génération d’images, et notifications en cas de sujet sensible.[8] Et sur Mac, ChatGPT s’intègre à Apple Messages : le plugin parcourt vos conversations, repère celles restées sans réponse, croise votre calendrier et rédige une réponse suggérée que vous pouvez modifier avant envoi via iMessage.[18]

Autre nouveauté utile pour les créateurs : les fonds transparents enfin disponibles en aperçu dans l’API pour GPT-Image-2. Quand on génère une image, elle sort en PNG propre, sans fond blanc à découper à la main. Pensez aux icônes d’app, aux mockups produit, aux stickers à poser sur un flacon ou aux personnages à insérer dans un décor. C’est une étape de moins entre l’idée et l’asset fini — et ça change la vie pour l’imagerie de campagne.[11]

Un robot plus rapide que le plus rapide des humains
La Chine a accueilli la deuxième édition des Jeux mondiaux des robots humanoïdes à Pékin, avec plus de 2 000 robots en compétition. Le fait marquant : le robot Tiangong Ultra a parcouru 100 mètres en 8,64 secondes, pulvérisant le record humain d’Usain Bolt (9,58 s). Petit détail savoureux : il n’a pas su s’arrêter et a percuté le matelas.[6] On a aussi vu des robots boxer avec gants et casques, se cogner et se faire tomber — et d’autres, tout à l’opposé, exécuter des enchaînements de Tai Chi d’une précision étonnante.

Derrière le spectacle, l’objectif est sérieux : ces robots n’apprennent pas à « faire du sport », mais à maîtriser la motricité du monde réel — la course, l’équilibre, la frappe, la coordination. Ce sont les compétences physiques qui leur serviront en usine, en logistique ou à domicile. La performance sportive n’est qu’un banc d’essai spectaculaire.
Matériel et gros contrats : Apple et l’Inde
Apple a mis à jour son Mac mini avec les puces M6 et M5 Pro. Sur le M6 (le premier chip gravé en 2 nm), Apple annonce jusqu’à 40 % de CPU en plus, deux fois plus de graphismes, deux fois plus de stockage et quatre fois plus de performance IA — grâce à un double Neural Engine 16 cœurs et des accélérateurs neuronaux dans chaque cœur GPU. La cible affichée est explicite : faire du Mac mini une machine d’« agentic computing » toujours active.[17] Pour un créateur qui fait tourner des modèles locaux, du montage vidéo ou du rendu 3D, c’est un vrai bond de confort.

Dans un tout autre registre, l’Inde confirme sa montée en puissance. Le géant de l’IT TCS rachète MHP, la filiale technologique de Porsche, pour environ 373 millions de dollars. Mais surtout, Porsche signe dans la foulée un contrat de 5 ans d’environ 1,5 milliard de dollars pour industrialiser l’IA dans ses domaines clés : ingénierie, usines, opérations et expérience client, avec un centre IA dédié.[9] Le message est clair : l’Inde n’est plus seulement un pays de back-office bon marché, elle devient un moteur technologique derrière des marques mondiales.

Les outils de création et de code changent de nature
C’est peut-être là que la semaine a le plus à dire pour ceux qui créent. Plusieurs outils passent de « assistant » à « coéquipier ».
Replit Free Mode : construisez des sites, designs, présentations et animations sans consommer vos crédits. Propulsé par GPT-5.6 Luna, un modèle économique, Replit bascule automatiquement sur un modèle plus puissant dès que la tâche exige du raisonnement. La vision affichée : que toute personne avec une connexion internet puisse lancer un produit.[14]

Claude Code a gagné un skill /design : tapez la commande, obtenez des artboards d’interface éditables, choisissez-en une, ajustez-la, puis demandez à Claude de la transformer en code. L’idée → le design → le code fonctionnel, dans le même outil.[15]

Slack Code transforme le chat d’équipe en espace de construction : mentionnez un agent (comme Claude), un canal de code partagé s’ouvre, partagez un fichier Figma et l’agent le lit, écrit le code et montre les changements — le tout sans quitter Slack.[19]

Cursor Origin, lui, attaque frontalement GitHub : hébergement de code directement dans Cursor, création de dépôt sans quitter l’éditeur, synchronisation depuis GitHub, revue de code et fusion sur place, avec CI via Depot et services via Vercel ou Buildkite.[20]

Claude s’est branché sur Gmail et Google Drive via ses connecteurs Workspace : retrouver les emails non lus des dernières 24h, lister vos fichiers récents, mais aussi répondre aux messages et gérer des fichiers avec votre approbation avant les actions importantes.[21]

Enfin, Replit Security Agent ajoute une équipe de sécurité intégrée : avant publication, un scan « white box » analyse votre code pour repérer les failles et secrets exposés, tandis qu’un test « black box » attaque l’application de l’extérieur comme le ferait un vrai hacker. Le tout se corrige d’un clic avec « Fix all with agent ».[22]

Les « coéquipiers IA » deviennent la norme
Le fil rouge de la semaine est sans doute là : on ne parle plus seulement de « bot » ou d’« assistant », mais de coéquipiers. Jack Dorsey a lancé Buzz via Block, une plateforme de chat open source où humains et agents travaillent au même niveau — vous décrivez l’aide dont vous avez besoin, et l’agent est créé avec ses instructions, son rôle et ses outils. L’objectif assumé : réduire la dépendance à Slack et GitHub.[12]

Meta AI sort une app dédiée pour Mac, qui combine dictation système ultra-précise et analyse d’écran, et se comporte en analyste de vos réseaux sociaux : elle compare vos performances à celles de marques similaires (followers, croissance, engagement) et vous explique pourquoi vous êtes en avance ou en retard.[13] Ces outils visent explicitement les créateurs et petites entreprises — un public qui nous ressemble.

Et pour ceux qui produisent de la vidéo, Gemini Omni 1.1 Flash mérite une mention : c’est un modèle vidéo qui se pilote presque comme un éditeur — prolonger une scène à partir d’une vidéo existante, interpoler entre une image de départ et une image de fin, passer le rendu en 4K. On décrit sa vision, on guide l’IA, on affine. Moins de montage manuel, plus de mise en scène.[7]

Ce que cela change pour les créateurs africains
Voici la partie qui vous concerne directement. Si vous créez du contenu, du design, du code ou de l’architecture depuis l’Afrique, ces annonces ne sont pas du luxe — elles ouvrent des portes.
D’abord, le prix. Un modèle comme GLM-5.3 Flash, gratuit à très faible coût, rend possibles des projets qui étaient financièrement fermés. Le Free Mode de Replit et l’offre Gemini pour étudiants abaissent encore la barrière : vous pouvez apprendre et produire sans budget.
Ensuite, la langue et l’accès. Une transcription à 85 langues et un assistant qui fait des recherches à la voix sont précieux dans des contextes où la connexion n’est pas toujours stable ni illimitée. Le fait d’avoir un outil qui travaille en arrière-plan et vous notifie correspond bien à des usages où l’on jongle entre plusieurs appareils et une connexion intermittente.
Enfin, la reconnaissance. Lorsque Google offre un an de son plan payant aux « étudiants du monde entier », et que Meta cible les créateurs et petites entreprises avec une app d’analyse, cela confirme une tendance : les grandes plateformes savent que la prochaine vague d’innovation peut venir de marchés émergents. La question n’est plus « ai-je accès à l’IA ? », mais « quelle valeur puis-je construire avec ? ».
Mon conseil de terrain : ne courez pas après chaque annonce. Choisissez un outil qui résout un problème précis de votre travail, maîtrisez-le, et laissez la concurrence faire baisser les prix pendant ce temps. La semaine l’a encore prouvé — la technologie avance vite, mais ce sont ceux qui l’utilisent avec méthode qui en tirent le plus.
Envie d’aller plus loin ?
Apprendre l’IA en français, à votre rythme
Sur ma chaîne YouTube, je partage des formations gratuites en français pour utiliser ces outils en pratique : Gemini, les assistants IA, la création de visuels et bien plus. Un bon moyen de transformer cette veille en compétences concrètes.
Sources
- [1]Z.ai — GLM-5.3 Flash — annonce officielle Z.ai (modèle Ox Alpha)
- [2]OpenRouter — GLM-5.3 Flash — fiche modèle et prix sur OpenRouter
- [3]Google — Un an de Gemini gratuit pour les étudiants — Blog Google
- [4]OpenAI — OpenAI et Broadcom dévoilent la puce d’inférence Jalapeño
- [5]The Decoder — Sam Altman : OpenAI pourrait atteindre l’AGI fin 2026 (Astra)
- [6]Reuters — Les robots humanoïdes et les limites de la vitesse humaine
- [7]Google — Gemini Omni 1.1 Flash — construire avec plus de contrôle
- [8]OpenAI — ChatGPT for Teens — pensé pour apprendre, protégé
- [9]CNBC — Porsche signe un accord IA d’1,5 milliard $ avec TCS
- [10]Google — Gemini 3.5 Transcribe — transcription intelligente
- [11]OpenAI — Arrière-plans transparents GPT-Image-2 — cookbook OpenAI
- [12]TechCrunch — Buzz — la plateforme de chat de Jack Dorsey pour équipes et agents IA
- [13]9to5Mac — Meta AI devient une app desktop Mac plus capable
- [14]Replit — Replit Free Mode — créer sans consommer de crédits (GPT-5.6 Luna)
- [15]Anthropic — Claude Code — nouveau skill /design
- [16]Google — Gemini Notebook — un carnet de recherche et de pensée
- [17]Apple — Apple dévoile un Mac mini plus puissant avec M6 et M5 Pro
- [18]TechCrunch — ChatGPT peut envoyer des SMS grâce au plugin Apple Messages
- [19]Slack — Slack Code — là où votre équipe et les agents construisent ensemble
- [20]Cursor — Cursor Origin — hébergement de code (changelog)
- [21]Anthropic — Connecteurs Google Workspace pour Claude
- [22]Replit — Replit Security Agent — l’équipe sécurité intégrée
