# AINEWS — 2026-10-01

45 articles.

## Une
- **Gemini 4 Argon : premier Gemini 4, d’abord réservé à Fairwind** — Google DeepMind annonce son modèle frontier le 30 septembre. Accès limité aux cyberdéfenseurs de confiance ; API et Ultra promis « as soon as possible ». — https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-4-argon/
- **GPT-6.1 Sol : upgrade à près d’Astra pour un cinquième du prix** — Sept jours après GPT-6 Sol, OpenAI pousse une version Work/Codex/API. Pas dans le chat grand public. — https://openai.com/index/introducing-gpt-6-1-sol/
- **Dots : agents always-on sur GPT-6 Astra, ordinateur cloud inclus** — Annonce DevDay du 29 septembre. Premier dot inclus pour Pro et Business Premium ; Enterprise en opt-in admin. — https://openai.com/index/introducing-dots/
- **OpenAI dit avoir stoppé une campagne coordonnée de distillation du raisonnement protégé** — Pics à 16 000 requêtes en juillet. Un cluster lié à des personnes associées à Moonshot (Kimi) ; partage via le Frontier Model Forum. — https://openai.com/index/disrupting-a-coordinated-model-distillation-campaign/
- **Accord Maison Blanche « morally binding » : quatre couches d’auto-contrôle pour les labs frontier** — Le 29 septembre, dirigeants tech signent un engagement volontaire sans sanction. The Verge y voit une promesse morale, pas une loi. — https://www.theverge.com/ai-artificial-intelligence/1002584/trump-us-ai-safety-deal-self-regulation-tech-execs

## Modèles
- **Gemini 4 Argon : 1 M de tokens en sortie, prix promo 2/10, pas encore public** — Premier modèle de la famille Gemini 4. Sortie textuelle record, usages internes documentés, accès cyber Fairwind sans guardrails. Sur Artificial Analysis, il égalise Astra sans prendre la tête face à Opus 5.5. — https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-4-argon/
- **GPT-6.1 Sol à un point d’Astra, Ultrafast live sur Astra jusqu’à ~300 t/s** — Annoncé à DevDay une semaine après GPT-6 Sol. Artificial Analysis : Index 52, moins d’un quart du coût par tâche d’Astra. Sol Ultrafast promis plus tard ; plan Pro 500 = 25× Plus. — https://openai.com/index/introducing-gpt-6-1-sol/
- **Gemini Skills remplacent les Gems : déploiement le 30 septembre** — Skills dans le chat Gemini pour les abonnés 18+. Invocation /nom, fichiers texte/PDF/images. Extinction Gems échelonnée jusqu’en juin 2027 ; migration automatique. — https://blog.google/products-and-platforms/products/gemini/automate-tasks-with-skills/
- **DeepSeek ouvre des outils Ascend avec Huawei : TileLang et supernode 128×950** — Annonce WeChat du 30 septembre, relayée par Reuters. Libs compute/comms open source, TileLang en alternative à CUDA. Pas de post sur le compte X @DeepSeek_AI. — https://www.reuters.com/world/asia-pacific/deepseek-partners-with-huawei-develop-chip-programming-tools-reducing-reliance-2026-09-30/
- **Claude sur Bedrock : Inde, Séoul, Singapour — pas de nouveau modèle Anthropic** — AWS étend Opus 5, Sonnet 5 et Haiku 4.5 en inférence régionale. À part : Qwen3.8-27B dense arrive sur Nebius, sans nouvelle famille Qwen. — https://aws.amazon.com/blogs/machine-learning/amazon-bedrock-expands-claude-model-availability-to-india-cross-region-inference/

## Harness
- **Claude Code 2.1.285–286 : allowlist de providers et retry au même palier** — Gestion managée des backends cloud, mode --bare, correctif du spend meter cache, et Stop/Esc qui épargne les agents de fond. — https://github.com/anthropics/claude-code/releases/tag/v2.1.285
- **Codex 0.159 : GPT-6.1 Sol devient le défaut, y compris sur Bedrock** — Sans pin modèle, les nouvelles sessions basculent sur Sol. 0.159.3 ajoute des rappels de setup sécurité ChatGPT. — https://github.com/openai/codex/releases/tag/rust-v0.159.1
- **Grok Build 1.0.45–46 : spawn_subagent custom et règles client persistantes** — MCP token file, MCP doctor, permission rules sous cwd symlink. Le changelog public x.ai reste figé à 1.0.44. — https://xstack.grok.me/changelog
- **Gemini CLI 0.62 : Flash 3.8 / 3.5 Lite ; la preview 0.63 ajoute le plan autonome** — Titres MCP ACP et PTY Windows en stable. geminicli.com affiche encore v0.61.0 ; des nightlies 0.64.0 existent déjà. — https://github.com/google-gemini/gemini-cli/releases/tag/v0.62.0
- **Sol par défaut chez Cline, Fusion Astra+SWE-2 chez Devin Desktop** — Cline 4.1.22 aligne OpenAI/OpenRouter/Copilot sur GPT-6.1 Sol. Devin 3.10.48 (ex-Windsurf) pousse ChatGPT sign-in et retire Cascade depuis 3.9.19. — https://github.com/cline/cline/releases/tag/v4.1.22

## Evals
- **Gemini 4 Argon (high) égale Astra à 53 sur l’Intelligence Index** — Un point devant GPT-6.1 Sol max (52). Promo à 1,99 $ par tâche ; hors promo, plus cher qu’Astra. Pas encore public. — https://artificialanalysis.ai/articles/gemini-4-argon-google-top-three-labs
- **GPT-6.1 Sol à 52 : un point sous Astra, moins d’un quart du coût par tâche** — AA confirme le remplacement de GPT-6 Sol sept jours après sa sortie. Les benches OpenAI restent des claims séparés. — https://artificialanalysis.ai/articles/gpt-6-1-sol-replaces-gpt-6-sol-after-just-7-days-with-near-astra-intelligence
- **DeepSWE v1.1 : Google et OpenAI racontent deux podiums** — Argon revendique le SOTA ; Sol se dit à égalité d’Astra pour ~1/5 du coût. Pas de départage ici. — https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-4-argon/
- **OSWorld-Science : le computer-use face aux logiciels scientifiques** — 146 tâches sur des outils de labo, avec notation sur artefacts. À ne pas confondre avec OSWorld 2.0. — https://huggingface.co/papers/2609.39903
- **GameSpec-Bench mesure la fidélité au GDD ; AA-AgentPerf-Local chronomètre le hardware** — Un bench coding agents sur documents de game design, et un outil AA du 29 septembre sur DGX Spark, Ryzen AI Halo, M5 Pro et RTX 5090. — https://huggingface.co/papers/2609.39564

## Image & vidéo
- **Transformers 5.18 : Nemotron 3 Diarization et NemotronH Omni** — Hugging Face intègre le 30 septembre un diariseur streaming open-weight NVIDIA et un Omni texte/image/vidéo/audio. Ce n’est pas une sortie frontier image ou vidéo labo. — https://github.com/huggingface/transformers/releases/tag/v5.18.0
- **ViTeX-Bench : éditer le texte d’une scène vidéo sans casser le plan** — 387 clips 720p, protocole à trois axes, accepté à NeurIPS 2026. Les auteurs sortent aussi ViTeX-Edit-14B, éditeur open-source de référence. — https://arxiv.org/abs/2609.40356
- **Grokipedia v0.3 : nouveau logo, étagère de « livres », live edits** — The Verge, 1er octobre. Après des mois sans mises à jour, l’encyclopédie IA de SpaceXAI reprend les edits et rafraîchit l’UI. Les articles eux-mêmes changent peu. — https://www.theverge.com/tech/1003068/elon-musk-grokipedia-v-0-3-spacexai
- **Dots et Muse Charm : l’IA se vend en Tamagotchi, pas en Pin** — The Verge et Wired, 30 septembre. OpenAI et Meta misent sur des agents mignons comme rampe vers du hardware dédié, après l’échec Friend / Humane. — https://www.theverge.com/ai-artificial-intelligence/1002779/openai-dots-meta-muse-ai-agents-hardware-devices
- **VoiceStudio explose en trending ; GLARE et MatLoom côté génération** — Le collecteur GitHub compte 3483 stars le 1er octobre pour une alternative locale à ElevenLabs. Deux papiers NeurIPS/arXiv du 30 septembre : têtes d’écoute et matériaux PBR en programmes. — https://github.com/debpalash/VoiceStudio

## Local & open source
- **Magnitude (YC S25) : moteur Rust Apache-2.0 autotuné face à llama.cpp** — Bench auteurs sur Qwen 3.6 35B A3B 4-bit ; sur HN, des users M5 Max restent sur llama.cpp + DFlash2. Pas de verdict. — https://github.com/magnitudedev/magnitude
- **llama.cpp 1er octobre : fix WebGPU SSM_SCAN, OpenCL et OpenVINO** — Cluster b11284–b11312 : backends, Harmony LLM-jp-4.1, KleidiAI macOS DISABLED. — https://github.com/ggml-org/llama.cpp/releases/tag/b11312
- **Axolotl v0.20.0 : export GGUF natif vers llama.cpp, Ollama et LM Studio** — Une commande `axolotl export --quantize` ; NVFP4 LoRA, Ringmaster CP, expert parallel sans DeepEP. — https://github.com/axolotl-ai-cloud/axolotl/releases/tag/v0.20.0
- **Ollama v0.35.1-rc0 : 10 recherches web par réponse, bump MLX et llama.cpp** — Pre-release du 29 septembre ; la stable 0.35.0 reste hors fenêtre. Sur Windows, un garde-fou RAM tiers apparaît. — https://github.com/ollama/ollama/releases/tag/v0.35.1-rc0
- **Quants et abliterated du jour : Marie sur Qwen3.8 Flash Next, Huihui, TwIL non-com** — Pas de classement. Licences et usage à lire avant de télécharger. Plusieurs dépôts à 0 download. — https://x.com/bnjmn_marie/status/2105481856812740726

## GPU
- **AMD rachète World Labs 8,2 Md$ : Fei-Fei Li chief scientist** — Communiqué AMD du 28 septembre, repris le 30. All-stock, closing visé fin 2026. World Labs apporte la spatial intelligence 3D ; Li reporte à Lisa Su. — https://newsroom.amd.com/news/amd-acquire-world-labs/
- **Vera Rubin NVL72 en prod chez CoreWeave : Cognition revendique +4,8× vs GB200** — Billet NVIDIA du 30 septembre. Devin tourne déjà sur les racks Rubin. Vera CPU : plus de 11 000 sandboxes isolées par rack. — https://blogs.nvidia.com/blog/coreweave-agentic-ai-vera-rubin/
- **OpenAI et Synopsys lancent GPT-Synopsys pour concevoir des puces** — Partenariat pluriannuel du 30 septembre. Le modèle doit piloter les outils EDA. Tests clients déjà en cours ; revenu partagé. — https://the-decoder.com/openai-and-synopsys-team-up-to-build-an-ai-model-that-designs-chips-like-a-seasoned-engineer/
- **Les Dots OpenAI tournent sur des VM EPYC 9 cœurs, ~6× Muse en Geekbench** — Tom's Hardware, 30 septembre. Leak Ubuntu, runs post-lancement Debian. ~10 Go de RAM. Tibo (DevDay) : le Linux cloud est préchargé avec Blender. — https://www.tomshardware.com/tech-industry/artificial-intelligence/geekbench-7-results-suggest-openais-dots-agent-runs-on-nine-core-amd-epyc-vms-with-nearly-10gb-of-memory-newest-runs-score-about-six-times-meta-muse-in-multi-core
- **Meta classe ses datacenters IA en « pilotes » pour le crédit impôt recherche** — The Decoder, 30 septembre, d’après le New York Times. 3,9 Md$ en 2025. Les puces Nvidia passent en matériaux expérimentaux. Les comptables internes jugent la stratégie juridiquement risquée. — https://the-decoder.com/meta-dodges-billions-in-us-taxes-by-calling-its-ai-data-centers-experiments/

## Papiers
- **SynthID Bio : un filigrane qui survit à la synthèse de protéines conçues par IA** — DeepMind publie le 30 septembre une méthode de watermark séquence et structure, validée en wet-lab sur des binders fonctionnels. — https://deepmind.google/blog/introducing-synthid-bio/
- **Premier audit public d’Astra comme politique incarnée : utile en hybride, fragile en locomotion dense** — Galbot évalue GPT-6 Astra en contrôle numérique direct et en mode hybride avec π0.5 ; 48 % sur un sous-ensemble RoboDojo, 92 % sur RxR, échec sur parcours denses. — https://arxiv.org/abs/2609.38537
- **Améliorer le harness sans toucher aux poids : meta-skills, évolution lifelong, et leçons de minimalisme** — Trois preprints convergent : construire de meilleurs environnements à modèles figés, apprendre depuis la littérature, et mesurer ce qu’un fort backbone rend redondant. — https://arxiv.org/abs/2609.38143
- **AREX-2 et TomasuLLM : self-amélioration longue horizon et tool calls hors ordre** — BAAI fine-tune Qwen3.8-27B sur des trajectoires réflexives ; TomasuLLM spécule les appels d’outils en CoW sans faux accept sur 4010 commits. — https://arxiv.org/abs/2609.38288
- **KV 2-bit, état récurrent 8-bit, MoE mono-GPU : trois leviers d’inférence** — WUSH-KV, LeapQuant et Mira attaquent cache KV, attention linéaire et experts MoE avec des gains mesurés sur SGLang, vLLM et GPU grand public. — https://arxiv.org/abs/2609.38121

## Analyses
- **Mollick : « 3-way race again », et le produit OpenAI redevient illisible** — Deux posts du 30 septembre. Argon remet Google dans la course. Dot, Spaces, Pages et Work se chevauchent. Les Dots vont saturer les SAV. — https://x.com/emollick/status/2105388608240677142
- **Acemoglu : si l’IA change tout, ce n’est pas aux labs de décider** — Thread du 30 septembre. Mollick : « one of the most important questions of the age ». Contre la technocratie des experts, pour une voix démocratique — y compris hors US/Europe/Chine. — https://x.com/DAcemogluMIT/status/2105348579187699989
- **Latent Space : le computer use a pivoté à 180°, OpenAI clone Jev en une semaine** — Premier pod post-DevDay. Ari Weinstein (ex-Sky, CUA OpenAI) répond à Dwarkesh. Nikunj Handa détaille Decisions API, Ultrafast, Agents API. — https://www.latent.space/p/devday-2026
- **Teachout à Marcus : dissoudre les récidivistes ; l’FTC ouvre une enquête** — Interview du 30 septembre. CFAA, produits défectueux, homicide corporatif. Post-scriptum : probe FTC sur Anthropic, OpenAI et d’autres labs. — https://garymarcus.substack.com/p/can-companies-like-openai-keep-getting
- **Matthew Green : le sandbox ne suffit pas, les agents ont déjà la mécanique d’un ver** — Simon Willison quote le 1er octobre un billet du 30 septembre. Payload + agent porteur, cache partagé aujourd’hui, Slack demain. — https://simonwillison.net/2026/Oct/1/matthew-green/

## Voix
- **Ethan Mollick** (@emollick) — « And its a 3-way race again…. » au drop Gemini 4 Argon, en quote de Logan Kilpatrick (prix intro 2/10). — https://x.com/emollick/status/2105388608240677142
- **Ethan Mollick** (@emollick) — Après une brève unification autour de l’app ChatGPT, Dot, Spaces, Pages, ChatGPT Work et tâches planifiées cloud/local se chevauchent à nouveau. Il ne sait plus quel outil a quelles permissions. — https://x.com/emollick/status/2105184972537528538
- **Ethan Mollick** (@emollick) — Les services clients des entreprises vont être submergés par des Dots, Muses et équivalents qui négocient vocale/chat pour de meilleurs deals ; les histoires d’économies déléguées aux agents vont virer. — https://x.com/emollick/status/2105370153466863709
- **Google DeepMind** (@GoogleDeepMind) — Annonce officielle Gemini 4 Argon : workflows coding, knowledge work, cyberdéfense ; rollout Fairwind auprès de testeurs de confiance. — https://x.com/GoogleDeepMind/status/2105388084154056939
- **Logan Kilpatrick** (@OfficialLoganK) — Gemini 4 Argon roll out aux cyberdéfenseurs dès aujourd’hui, plus largement « as soon as possible ». Prix intro 2 $ in / 10 $ out. — https://x.com/OfficialLoganK/status/2105388054274080946
- **OpenAI** (@OpenAI) — Astra Ultrafast live (Codex, Work, API), jusqu’à 8× plus rapide, autour de 300 tokens/s. Plan Pro 500 = 25× l’usage Plus. Sol Ultrafast annoncé plus tard. — https://x.com/OpenAI/status/2104993967985381673
- **Alibaba Qwen** (@Alibaba_Qwen) — Qwen3.8-27B dense disponible sur Nebius Token Factory. Pas une nouvelle famille Qwen. — https://x.com/Alibaba_Qwen/status/2105256053403508849
- **Benjamin Marie** (@bnjmn_marie) — Eval de 11 GGUF Qwen3.8 Flash Next : >95 % de la précision BF16 y compris en IQ1, mais +14 % à +157 % de tokens de sortie selon le quant. Pas un ranking. — https://x.com/bnjmn_marie/status/2105481856812740726
- **Daron Acemoglu** (@DAcemogluMIT) — Si l’IA transforme autant qu’on le dit, sa direction ne peut pas être déléguée à la technocratie des labs. La voix démocratique est essentielle, y compris hors US/Europe/Chine. Mollick relaie : « Who decides what happens with AI? » — https://x.com/DAcemogluMIT/status/2105348579187699989
