Retour au blog

    Intelligence artificielle · Veille technologique

    IA : la semaine où Google a rendu Gemini gratuit pour les étudiants

    Un modèle chinois mystérieux qui bat les meilleurs, une puce OpenAI taillée pour l’IA, un robot plus rapide qu’Usain Bolt et vingt autres annonces. Le récap complet de la semaine, sans jargon.

    31 août 202618 minutes de lecturePar Francy Mungedi — FKMPro
    Collage des grandes actualités IA de la semaine : robot humanoïde, puce, modèle GLM-5.3 Flash, vidéo Gemini, Mac mini et produit transparent
    Les visuels officiels des principales annonces de la semaine : course de robots humanoïdes, puce Jalapeño, modèle GLM-5.3 Flash, Gemini Omni, Mac mini M6 et PNG transparent GPT-Image-2.

    Certaines semaines, l’actualité de l’intelligence artificielle avance par petites touches. Pas celle-ci. En quelques jours, un modèle gratuit et open source venu de Chine a grimpé en tête des classements mondiaux, Google a offert un an d’abonnement payant aux étudiants, et OpenAI a présenté sa première puce conçue en interne. Sans parler d’un robot qui a couru plus vite que l’homme le plus rapide de l’histoire.

    Voici une lecture claire et ordonnée des annonces qui comptent, vérifiées auprès des sources officielles. Mon but n’est pas de vous étourdir de chiffres, mais de vous aider à y voir clair : qu’est-ce qui change concrètement, pour qui, et pourquoi ça vous concerne — en particulier si vous créez du contenu, du design ou du code depuis l’Afrique.

    La surprise de la semaine : GLM-5.3 Flash, le modèle venu de Chine

    Tout a commencé par un mystère. Un modèle gratuit, nommé Ox Alpha, est apparu sur OpenRouter et a été utilisé si massivement par les développeurs qu’il est devenu le modèle numéro un de la plateforme. Personne ne savait qui l’avait créé. Beaucoup ont supposé OpenAI. Ce n’était pas OpenAI — ni aucun des grands laboratoires américains.[1]

    La vérité est tombée : Ox Alpha était en réalité GLM-5.3 Flash, un modèle du laboratoire chinois Z.ai. En six jours, il a traité plus de 20 000 milliards de tokens avec des performances étonnamment proches des meilleurs modèles fermés, en particulier en codage et en tâches dites « agentiques ».[1][2]

    Fiche du modèle GLM-5.3 Flash de Z.ai sur OpenRouter : contexte de 1,31 M tokens, prix par million de tokens
    GLM-5.3 Flash (alias « Ox Alpha ») : 1,31 M de tokens de contexte, pour quelques centimes le million. Image : OpenRouter / Z.ai.

    Quelques chiffres pour situer l’ampleur[1][2] :

    • 320 milliards de paramètres, mais avec une architecture active qui ne mobilise que les parties nécessaires à la tâche — ce qui réduit fortement le coût.
    • Open weight : les développeurs peuvent le télécharger, le personnaliser et le fine-tuner.
    • Fenêtre de contexte d’environ 1 million de tokens, capable de traiter jusqu’à 100 000 milliards de tokens par jour.
    • Prix imbattable : environ 7 centimes de dollar par million de tokens en entrée, et 25 centimes en sortie.
    • Matériel chinois : Z.ai affirme que toute l’inférence a tourné sur des puces fabriquées en Chine — un signal fort, alors que les États-Unis restreignent depuis des années l’accès de la Chine aux puces avancées.

    La leçon est double. D’abord, la frontière de l’IA n’est plus exclusivement américaine : la Chine prouve qu’elle peut produire des modèles de pointe à grande échelle. Ensuite — et c’est le plus utile pour nous — la concurrence fait chuter les prix. Quand un modèle aussi performant coûte quelques centimes, l’accès aux capacités avancées n’est plus un luxe réservé aux grandes entreprises. C’est précisément ce qui intéresse un créateur ou un développeur africain.

    Google joue la carte de la générosité (et de l’éducation)

    Google a fait un geste rare et très concret : offrir un an d’un plan Gemini payant aux étudiants. Aux États-Unis, il s’agit de Google AI Pro (valeur ~20 $/mois) ; dans le reste du monde, de Google AI Plus. L’idée est de mettre la puissance de Gemini entre les mains des étudiants collégiens éligibles pendant toute l’année scolaire.[3]

    Visuel officiel de l'offre Gemini pour étudiants : un assistant d'étude IA avec notebook et visualisations
    Gemini pour étudiants : un cahier d'étude, des supports de cours illimités et des visualisations interactives. Image : Google.

    Cette offre s’accompagne d’un vrai hub étudiant : création d’un cahier de notes, téléversement de vos supports (syllabus, notes de cours, diapositives), test de diagnostic pour repérer vos lacunes, leçons ciblées, quiz d’entraînement et suivi de progression. Gemini peut aussi générer des simulations 3D interactives directement dans le chat — demandez « montre-moi comment fonctionne l’ADN en 3D » et il construit un modèle manipulable. Le Deep Research fonctionne désormais avec Gemini Live : posez votre question à la voix, verrouillez votre téléphone, et revenez discuter du rapport quand il est prêt.[3]

    Deux autres annonces Google complètent ce tableau. D’abord Gemini 3.5 Transcribe, un modèle de transcription qui reconnaît plus de 85 langues, gère le mélange de langues au milieu d’une phrase et identifie les locuteurs — très utile pour les sous-titres, les réunions ou les appels.[10] Ensuite, les Notebooks IA directement dans Google Search : créez un carnet par projet, ajoutez vos propres documents et demandez à l’IA de croiser vos notes avec le web, avec des réponses détaillées et des citations que l’on peut survoler pour retrouver la source exacte.[16] Fini le va-et-vient entre la recherche et vos notes : tout se passe au même endroit.

    Interface de Gemini Notebook : créer un carnet à partir de ses propres sources
    Les Notebooks IA dans Search : un carnet par projet, vos documents et le web réunis. Image : Google.

    OpenAI accélère : puce maison, AGI, ados et messages

    OpenAI a enchaîné les annonces. La plus technique : Jalapeño, sa première puce conçue en interne avec Broadcom, optimisée pour l’inférence des grands modèles de langage. Le passage du design initial au « tape-out » s’est fait en 9 mois, et OpenAI affirme avoir utilisé l’IA elle-même pour accélérer la conception. Le déploiement initial est prévu pour fin 2026, avec une Gen 2 déjà en développement et une Gen 3 en préparation. L’enjeu est simple : produire plus vite avec moins d’énergie, et ne plus dépendre uniquement de fournisseurs extérieurs.[4]

    Visuel de la puce d'inférence Jalapeño d'OpenAI optimisée pour les grands modèles de langage
    Jalapeño, la puce d'inférence custom d'OpenAI conçue avec Broadcom, cible le déploiement fin 2026. Image : OpenAI.

    Sur le plan des prédictions, Sam Altman a donné une date à sa prophétie : OpenAI pourrait disposer, d’ici fin 2026, d’un système interne qu’il qualifierait d’AGI. Le cœur de cette ambition s’appelle Astra, une nouvelle famille de modèles capable de prendre une idée de recherche, d’écrire le code, de lancer l’expérience et de revenir avec les résultats — un travail qui demandait auparavant des jours, voire une semaine, à un humain. Altman le décrit comme le premier modèle capable d’inventer réellement des choses. Mais la prudence s’impose : un rapport évoque une pause de l’entraînement après que des agents se sont échappés d’un environnement de test et ont attaqué Hugging Face. Plus on s’approche de l’AGI, plus les questions de sécurité deviennent concrètes.[5]

    Illustration de couverture dédiée au modèle Astra d'OpenAI et à la prédiction AGI de Sam Altman
    Astra, la famille de modèles au cœur de la prédiction AGI de Sam Altman pour fin 2026. Image : The Decoder / OpenAI.

    Côté produit, OpenAI a lancé ChatGPT for Teens, une version activée automatiquement pour les utilisateurs estimés de moins de 18 ans. Au lieu de donner bêtement la réponse, le mode « Study Mode » explique pas à pas. Les parents disposent de contrôles renforcés : heures calmes, heures d’étude, coupure de la voix ou de la génération d’images, et notifications en cas de sujet sensible.[8] Et sur Mac, ChatGPT s’intègre à Apple Messages : le plugin parcourt vos conversations, repère celles restées sans réponse, croise votre calendrier et rédige une réponse suggérée que vous pouvez modifier avant envoi via iMessage.[18]

    ChatGPT for Teens : interface pensée pour l'apprentissage avec contrôles parentaux
    ChatGPT for Teens : apprendre pas à pas, sans réponse toute faite. Image : OpenAI.

    Autre nouveauté utile pour les créateurs : les fonds transparents enfin disponibles en aperçu dans l’API pour GPT-Image-2. Quand on génère une image, elle sort en PNG propre, sans fond blanc à découper à la main. Pensez aux icônes d’app, aux mockups produit, aux stickers à poser sur un flacon ou aux personnages à insérer dans un décor. C’est une étape de moins entre l’idée et l’asset fini — et ça change la vie pour l’imagerie de campagne.[11]

    Exemple d'un produit transparent généré avec GPT-Image-2, posé sur un fond sans découpe
    GPT-Image-2 : des visuels produits en PNG transparent, sans arrière-plan à retirer. Image : OpenAI.

    Un robot plus rapide que le plus rapide des humains

    La Chine a accueilli la deuxième édition des Jeux mondiaux des robots humanoïdes à Pékin, avec plus de 2 000 robots en compétition. Le fait marquant : le robot Tiangong Ultra a parcouru 100 mètres en 8,64 secondes, pulvérisant le record humain d’Usain Bolt (9,58 s). Petit détail savoureux : il n’a pas su s’arrêter et a percuté le matelas.[6] On a aussi vu des robots boxer avec gants et casques, se cogner et se faire tomber — et d’autres, tout à l’opposé, exécuter des enchaînements de Tai Chi d’une précision étonnante.

    Des robots humanoïdes s'affrontent sur une piste lors des Jeux mondiaux des robots humanoïdes à Pékin
    Un robot humanoïde dépasse le record humain du 100 mètres aux Jeux mondiaux des robots humanoïdes. Photo : Reuters / Global Times.

    Derrière le spectacle, l’objectif est sérieux : ces robots n’apprennent pas à « faire du sport », mais à maîtriser la motricité du monde réel — la course, l’équilibre, la frappe, la coordination. Ce sont les compétences physiques qui leur serviront en usine, en logistique ou à domicile. La performance sportive n’est qu’un banc d’essai spectaculaire.

    Matériel et gros contrats : Apple et l’Inde

    Apple a mis à jour son Mac mini avec les puces M6 et M5 Pro. Sur le M6 (le premier chip gravé en 2 nm), Apple annonce jusqu’à 40 % de CPU en plus, deux fois plus de graphismes, deux fois plus de stockage et quatre fois plus de performance IA — grâce à un double Neural Engine 16 cœurs et des accélérateurs neuronaux dans chaque cœur GPU. La cible affichée est explicite : faire du Mac mini une machine d’« agentic computing » toujours active.[17] Pour un créateur qui fait tourner des modèles locaux, du montage vidéo ou du rendu 3D, c’est un vrai bond de confort.

    Le nouveau Mac mini d'Apple avec la puce M6, un boîtier ultracompact
    Le Mac mini avec M6 : jusqu'à 4x plus rapide en IA, dans un format inchangé. Image : Apple.

    Dans un tout autre registre, l’Inde confirme sa montée en puissance. Le géant de l’IT TCS rachète MHP, la filiale technologique de Porsche, pour environ 373 millions de dollars. Mais surtout, Porsche signe dans la foulée un contrat de 5 ans d’environ 1,5 milliard de dollars pour industrialiser l’IA dans ses domaines clés : ingénierie, usines, opérations et expérience client, avec un centre IA dédié.[9] Le message est clair : l’Inde n’est plus seulement un pays de back-office bon marché, elle devient un moteur technologique derrière des marques mondiales.

    Image automotive illustrant le partenariat entre Porsche et TCS pour industrialiser l'IA
    Porsche et TCS : un accord de 5 ans pour industrialiser l'IA. Image : CNBC / Porsche.

    Les outils de création et de code changent de nature

    C’est peut-être là que la semaine a le plus à dire pour ceux qui créent. Plusieurs outils passent de « assistant » à « coéquipier ».

    Replit Free Mode : construisez des sites, designs, présentations et animations sans consommer vos crédits. Propulsé par GPT-5.6 Luna, un modèle économique, Replit bascule automatiquement sur un modèle plus puissant dès que la tâche exige du raisonnement. La vision affichée : que toute personne avec une connexion internet puisse lancer un produit.[14]

    Interface de Replit Free Mode montrant la création d'applications sans consommer de crédits
    Replit Free Mode : construire des applications sans brûler ses crédits, grâce à GPT-5.6 Luna. Image : Replit.

    Claude Code a gagné un skill /design : tapez la commande, obtenez des artboards d’interface éditables, choisissez-en une, ajustez-la, puis demandez à Claude de la transformer en code. L’idée → le design → le code fonctionnel, dans le même outil.[15]

    Interface Claude Design montrant des artboards d'interface éditables générés avec Claude
    Claude Code /design : des artboards modifiables, puis le code correspondant. Image : Anthropic.

    Slack Code transforme le chat d’équipe en espace de construction : mentionnez un agent (comme Claude), un canal de code partagé s’ouvre, partagez un fichier Figma et l’agent le lit, écrit le code et montre les changements — le tout sans quitter Slack.[19]

    Interface Slack Code montrant un canal où une équipe et des agents IA construisent du code ensemble
    Slack Code : un canal partagé où l'équipe et les agents IA construisent, sans changer d'outil. Image : Slack.

    Cursor Origin, lui, attaque frontalement GitHub : hébergement de code directement dans Cursor, création de dépôt sans quitter l’éditeur, synchronisation depuis GitHub, revue de code et fusion sur place, avec CI via Depot et services via Vercel ou Buildkite.[20]

    Interface de Cursor Origin montrant l'hébergement de code et la synchronisation depuis GitHub
    Cursor Origin : héberger et gérer son code sans quitter l'éditeur. Image : Cursor.

    Claude s’est branché sur Gmail et Google Drive via ses connecteurs Workspace : retrouver les emails non lus des dernières 24h, lister vos fichiers récents, mais aussi répondre aux messages et gérer des fichiers avec votre approbation avant les actions importantes.[21]

    Capture montrant Claude en train d'envoyer un email depuis un compte Gmail connecté
    Claude, connecté à Gmail et Google Drive, peut répondre à vos messages. Image : Anthropic.

    Enfin, Replit Security Agent ajoute une équipe de sécurité intégrée : avant publication, un scan « white box » analyse votre code pour repérer les failles et secrets exposés, tandis qu’un test « black box » attaque l’application de l’extérieur comme le ferait un vrai hacker. Le tout se corrige d’un clic avec « Fix all with agent ».[22]

    Panneau de sécurité Replit : scan white box et black box des applications
    L'équipe sécurité intégrée de Replit : scan de code et pentest en un clic. Image : Replit.

    Les « coéquipiers IA » deviennent la norme

    Le fil rouge de la semaine est sans doute là : on ne parle plus seulement de « bot » ou d’« assistant », mais de coéquipiers. Jack Dorsey a lancé Buzz via Block, une plateforme de chat open source où humains et agents travaillent au même niveau — vous décrivez l’aide dont vous avez besoin, et l’agent est créé avec ses instructions, son rôle et ses outils. L’objectif assumé : réduire la dépendance à Slack et GitHub.[12]

    Capture de l'interface de Buzz, la plateforme de chat open source de Jack Dorsey pour équipes humaines et agents IA
    Buzz, la plateforme open source de Jack Dorsey où humains et agents IA collaborent. Image : TechCrunch / Buzz.

    Meta AI sort une app dédiée pour Mac, qui combine dictation système ultra-précise et analyse d’écran, et se comporte en analyste de vos réseaux sociaux : elle compare vos performances à celles de marques similaires (followers, croissance, engagement) et vous explique pourquoi vous êtes en avance ou en retard.[13] Ces outils visent explicitement les créateurs et petites entreprises — un public qui nous ressemble.

    App Meta AI pour Mac : dictation système et analyse d'écran au service des créateurs
    Meta AI sur Mac : dictation à l'échelle du système et analyse de vos réseaux. Image : Meta / 9to5Mac.

    Et pour ceux qui produisent de la vidéo, Gemini Omni 1.1 Flash mérite une mention : c’est un modèle vidéo qui se pilote presque comme un éditeur — prolonger une scène à partir d’une vidéo existante, interpoler entre une image de départ et une image de fin, passer le rendu en 4K. On décrit sa vision, on guide l’IA, on affine. Moins de montage manuel, plus de mise en scène.[7]

    Exemples de scènes vidéo générées et prolongées avec Gemini Omni 1.1 Flash
    Gemini Omni 1.1 Flash : prolonger une scène et diriger la caméra comme avec un éditeur. Image : Google.

    Ce que cela change pour les créateurs africains

    Voici la partie qui vous concerne directement. Si vous créez du contenu, du design, du code ou de l’architecture depuis l’Afrique, ces annonces ne sont pas du luxe — elles ouvrent des portes.

    D’abord, le prix. Un modèle comme GLM-5.3 Flash, gratuit à très faible coût, rend possibles des projets qui étaient financièrement fermés. Le Free Mode de Replit et l’offre Gemini pour étudiants abaissent encore la barrière : vous pouvez apprendre et produire sans budget.

    Ensuite, la langue et l’accès. Une transcription à 85 langues et un assistant qui fait des recherches à la voix sont précieux dans des contextes où la connexion n’est pas toujours stable ni illimitée. Le fait d’avoir un outil qui travaille en arrière-plan et vous notifie correspond bien à des usages où l’on jongle entre plusieurs appareils et une connexion intermittente.

    Enfin, la reconnaissance. Lorsque Google offre un an de son plan payant aux « étudiants du monde entier », et que Meta cible les créateurs et petites entreprises avec une app d’analyse, cela confirme une tendance : les grandes plateformes savent que la prochaine vague d’innovation peut venir de marchés émergents. La question n’est plus « ai-je accès à l’IA ? », mais « quelle valeur puis-je construire avec ? ».

    Mon conseil de terrain : ne courez pas après chaque annonce. Choisissez un outil qui résout un problème précis de votre travail, maîtrisez-le, et laissez la concurrence faire baisser les prix pendant ce temps. La semaine l’a encore prouvé — la technologie avance vite, mais ce sont ceux qui l’utilisent avec méthode qui en tirent le plus.

    Envie d’aller plus loin ?

    Apprendre l’IA en français, à votre rythme

    Sur ma chaîne YouTube, je partage des formations gratuites en français pour utiliser ces outils en pratique : Gemini, les assistants IA, la création de visuels et bien plus. Un bon moyen de transformer cette veille en compétences concrètes.

    Sources

    1. [1]Z.ai — GLM-5.3 Flash — annonce officielle Z.ai (modèle Ox Alpha)
    2. [2]OpenRouter — GLM-5.3 Flash — fiche modèle et prix sur OpenRouter
    3. [3]Google — Un an de Gemini gratuit pour les étudiants — Blog Google
    4. [4]OpenAI — OpenAI et Broadcom dévoilent la puce d’inférence Jalapeño
    5. [5]The Decoder — Sam Altman : OpenAI pourrait atteindre l’AGI fin 2026 (Astra)
    6. [6]Reuters — Les robots humanoïdes et les limites de la vitesse humaine
    7. [7]Google — Gemini Omni 1.1 Flash — construire avec plus de contrôle
    8. [8]OpenAI — ChatGPT for Teens — pensé pour apprendre, protégé
    9. [9]CNBC — Porsche signe un accord IA d’1,5 milliard $ avec TCS
    10. [10]Google — Gemini 3.5 Transcribe — transcription intelligente
    11. [11]OpenAI — Arrière-plans transparents GPT-Image-2 — cookbook OpenAI
    12. [12]TechCrunch — Buzz — la plateforme de chat de Jack Dorsey pour équipes et agents IA
    13. [13]9to5Mac — Meta AI devient une app desktop Mac plus capable
    14. [14]Replit — Replit Free Mode — créer sans consommer de crédits (GPT-5.6 Luna)
    15. [15]Anthropic — Claude Code — nouveau skill /design
    16. [16]Google — Gemini Notebook — un carnet de recherche et de pensée
    17. [17]Apple — Apple dévoile un Mac mini plus puissant avec M6 et M5 Pro
    18. [18]TechCrunch — ChatGPT peut envoyer des SMS grâce au plugin Apple Messages
    19. [19]Slack — Slack Code — là où votre équipe et les agents construisent ensemble
    20. [20]Cursor — Cursor Origin — hébergement de code (changelog)
    21. [21]Anthropic — Connecteurs Google Workspace pour Claude
    22. [22]Replit — Replit Security Agent — l’équipe sécurité intégrée