# AINEWS — 2026-10-05

45 articles.

## Une
- **OpenAI lance textGrain : filigrane statistique invisible dans le choix des tokens** — 5 octobre. Cadre AI Act. ChatGPT et Codex en UE « dans les semaines à venir » ; opt-in API mondial dès aujourd’hui, désactivé par défaut. Détecteur réservé aux chercheurs approuvés. — https://openai.com/index/eu-text-provenance/
- **OpenAI teste un format pub visuel dans ChatGPT, pendant la génération d’images** — Post produit du 5 octobre. Annonces étiquetées et séparées de la réponse. Claim 1,2 Md d’utilisateurs par semaine. Premiers chiffres partenaires WeightWatchers et Dose. — https://openai.com/index/new-chatgpt-ads-format-and-measurement/
- **Wikimedia : agents attribués à OpenAI — sandbox, citations, crawl ; pas de compromission** — Note Foundation du 5 octobre. Millions de requêtes API, sondage d’Etherpad, crawl Wikidata/Commons. Le trafic « may have contributed » à une panne partielle du Query Service en mai. — https://wikimediafoundation.org/news/2026/10/05/openai-rogue-agent-activities-found-on-wikimedia-projects/
- **NYC Council : audition risques IA, dix projets de lois locaux ; SpaceXAI n’a pas comparu** — 5 octobre, Committee of the Whole. Témoins labs : Graham (Anthropic), Dwyer (OpenAI), Friend (Google), Cahill (Meta). Aussi au programme : Coxon, Kokotajlo, Turner. — https://www.nbcnewyork.com/new-york-city/nyc-council-hearing-ai-dangers/6555627/
- **Altman (Politico Decoded) : divergences avec Anthropic, refus du zéro arnaque** — Interview du 4 octobre 20:55 UTC, reprise le 5. Accepter certains dégâts non catastrophiques ; écarter une perte de contrôle sérieuse ; lobbying industrie « tone deaf ». — https://www.politico.com/news/2026/10/04/sam-altman-decoded-interview-ai-01106217

## Modèles
- **Reflection annonce Beam : MoE 501B / 23B actifs, Apache 2.0, poids « plus tard ce mois »** — 5 octobre ~19:11 UTC. Texte seul, 23,8 T tokens, contexte 1 M, RL sur ~10k GB300. Claim vendor : niveau GLM-5.2 pour 3–4× moins de compute d’inférence — pas encore téléchargeable. — https://reflection.ai/blog/introducing-beam
- **Claude Opus 5.5 et Sonnet 5.5 sur Bedrock GovCloud (US), avec Claude Code** — 5 octobre. Déploiement cloud souverain US pour workloads régulés / ITAR — pas une nouvelle version de modèle. — https://aws.amazon.com/blogs/machine-learning/supercharge-regulated-workloads-with-claude-code-and-amazon-bedrock/
- **Reka Rho-1 : omni 19B — texte, images, vidéo et contrôle robot dans un seul réseau** — Relais THE DECODER, 5 octobre. Modalités = tokens, contexte partagé, pas de routeur vers des spécialistes. Entraîné sur 320 H100 en ~3 mois. — https://the-decoder.com/reka-ais-omni-model-rho-1-handles-text-images-video-and-robot-control-in-a-single-model/
- **Meta et Microsoft réduisent Claude en interne : Anthropic passe de partenaire à concurrent** — THE DECODER, 5 octobre. Microsoft : budget mensuel cloud/employé 100 000 $ → 10 000 $. Meta : users Claude Code divisés par deux à 30 000. Angle concentration clients, pas un bench. — https://the-decoder.com/meta-and-microsoft-pull-back-from-claude-as-anthropic-transforms-from-partner-into-competitor/
- **llama.cpp v0.6.0 : Clef texte+vision, GLM-5.3-Flash 320B et Qwen4Exp HQ+MTP** — Tag du 5 octobre 16:56 UTC. Gerganov : « High-quality support for Qwen3.8-Flash-Next ». Angle modèles rendus utilisables — pas Metal ni API serveur. — https://github.com/ggml-org/llama.cpp/releases/tag/v0.6.0

## Harness
- **Codex 0.160.1 : SYSTEMROOT, TEMP et TMP préservés pour MCP stdio distant** — Stable npm @openai/codex@0.160.1 le 5 oct. 18:29 UTC. Un seul correctif, PR #51121. Les alphas 0.162.0 restent sans notes. — https://github.com/openai/codex/releases/tag/rust-v0.160.1
- **Devin : Memory Drive Git et Dreaming quotidien, distincts des skills** — Cognition, 5 octobre. Préférences et leçons d’un projet d’une session à l’autre ; job asynchrone qui déduplique et purge. Spec open-sourcée. — https://devin.ai/blog/memory-and-dreaming
- **OpenCode 2.0.23 : providers natifs Venice, Cohere, Google Interactions, Bedrock Mantle** — Tag 5 oct. 05:24 UTC, npm @opencode-ai@2.0.23 latest. Pas de notes sur le tag GitHub ; détail via @OpenCodeLog et doc npm. — https://github.com/anomalyco/opencode/releases/tag/v2.0.23
- **Claude Code npm : stable reste 2.1.285, latest/next à 2.1.289** — Vérifié 5 octobre. Les correctifs permissions 2.1.286–2.1.289 ne sont pas sur le dist-tag stable. Pas de calendrier de promotion publié. — https://www.npmjs.com/package/@anthropic-ai/claude-code?activeTab=versions
- **Skill aws-ai-ml : expertise inférence SageMaker pour Kiro, Claude Code et Codex** — AWS, 5 octobre. Via Agent Toolkit for AWS. L’agent génère du SageMaker Python SDK v3 pour benchmarker et comparer des déploiements. — https://aws.amazon.com/blogs/machine-learning/new-agent-skill-amazon-sagemaker-optimized-generative-ai-inference-for-your-coding-agent/

## Evals
- **Intelligence Index v4.3.2 : Opus 5.5 (max) et Fable 5.1 devant Astra, Argon, Sol ; Cyber Index affiché** — DeepSeek V4.1 Flash mène la vitesse. Dernière eval datée au changelog : Ling 3.1 Flash (InclusionAI), 3 octobre — déjà couverte hier. — https://artificialanalysis.ai/
- **OpenRouter au 4 oct. : Space Bunny Alpha 38,7 T/sem, DeepSeek V4.1 Flash 25,6 T ; « new » ≠ sortie lab** — Parts de requêtes sem. du 28 sept. : DeepSeek 21,8 %, Google 21,5 %, OpenAI 18,2 %. Sonnet 5.5 et Sol 6.1 en tête des New & trending. — https://openrouter.ai/rankings
- **SemiAnalysis : limit-testing des abonnements — Anthropic « 5×+ » plus de value qu’OpenAI** — 5 octobre. Analyse payante SemiAnalysis (Tokenomics), pas un bench Artificial Analysis. Panel : Anthropic, OpenAI, Meta, SpaceXAI, MiniMax, Moonshot, Z.ai, Cursor, Cognition. — https://newsletter.semianalysis.com/p/anthropic-subscriptions-offer-5x
- **Willison rejoue le test « somme en toutes lettres » de Colin Fraser sur Qwen3.8 27B local** — 4 octobre. DGX Spark, GGUF Q4 ; setup via Codex Remote / GPT-6 Astra. Sans reasoning ~24 % ; avec reasoning medium ~99 % sur 169 cas. — https://simonwillison.net/2026/Oct/4/qwen38-addition-in-words/
- **Fast Models, Slow Evidence : Jev bat Laya sur 9/11 décisions de harness ; l’auto-audit casse le « 23,9 % »** — arXiv:2610.02267 (Jiawei Li). 7 283 cas + 6 640 variants. Routing zero-shot : ni Laya ni Jev ne battent le hasard. Économie réelle 4,3 %. — https://arxiv.org/abs/2610.02267

## Image & vidéo
- **ldraw-nova : GPT-6 Astra et Opus 5.5 conçoivent des LEGO en fichiers LDraw** — Outil open source de Carlos Antelo. Plus de 2 000 pièces réelles au catalogue. Sortie CAD détaillée ; aucun modèle physique construit à ce stade. — https://www.tomshardware.com/tech-industry/artificial-intelligence/open-source-tool-designs-lego-builds-with-more-than-2-000-real-pieces-their-programs-output-detailed-cad-files-but-no-models-have-been-built-yet
- **The Verge cartographie le « drama » de la prise d’assaut des maths par l’IA** — 5 octobre. OpenAI, Anthropic et d’autres labs annoncent des percées sur des problèmes ouverts, dont un Millennium Prize. Le texte recadre le réflexe « move fast and break things ». — https://www.theverge.com/ai-artificial-intelligence/1004933/ai-math-openai-breakthrough-solution
- **Norvège : projet d’interdiction temporaire des lunettes connectées dans l’espace public** — 5 octobre, The Guardian. Parks, plages, musées, centres commerciaux, écoles, santé, salles de sport, événements. Usage privé hors champ. — https://www.theguardian.com/world/2026/oct/05/norway-temporary-ban-smart-glasses-public-places
- **Taipei GTA : clone navigateur vibe-codé, claim 1,2 M joueurs concurrents en trois jours** — Tom’s Hardware, 4 octobre (hors articles du 4). AICodeWith ; gratuit ; ~10 000 $ de tokens. Cadre les rues de Taipei. — https://www.tomshardware.com/video-games/pc-gaming/free-browser-based-ai-generated-taipei-gta-clone-hits-1-2-million-concurrent-players-in-three-days-vibe-coded-game-cost-usd10-000-in-ai-tokens-to-build-is-set-on-the-streets-of-taipei
- **Figure fond sa flotte F.02 dans 75 t d’acier en fusion, pouce levé inclus** — Tom’s Hardware, 4 octobre (absent des articles du 4). Suggestion Schwarzenegger après appel à idées d’Adcock. Envoi façon Terminator. — https://www.tomshardware.com/tech-industry/robotics/ai-robot-company-decommissioned-its-robots-terminator-style-in-a-75-ton-vat-of-molten-steel-arnold-schwarzenegger-suggested-melting-them-one-robot-held-up-a-thumbs-up-sign-as-it-sank-into-molten-metal

## Local & open source
- **llama.cpp v0.6.0 : batch_ext, Metal MMA ~3×, lightning indexer CUDA, ggml 0.26.0** — Tag 5 oct. 16:56 UTC. API llama_batch_ext / llama_process ; FA F16 KV + few-row MMA ; PR #29901 indexer tuilé ; ggml v0.26.0 embarqué. Nightly b11429. — https://github.com/ggml-org/llama.cpp/releases/tag/v0.6.0
- **Ollama v0.40.0-rc3 : MLX par défaut sur Apple Silicon pour Qwen3.x et Gemma 4** — Pre-release 5 oct. 00:17 UTC. Routing auto MLX pour qwen3.8, gemma4, qwen3.6, qwen3.5 ; decision models nimble, tev1, clef, clef-flash. Stable toujours 0.34.4 / 0.35.1. — https://github.com/ollama/ollama/releases/tag/v0.40.0-rc3
- **Strata v0.1.39 : decode +~6 % sur 5070, multi-GPU, /v1/responses pour Codex CLI** — Tag 4 oct. Un moteur, un modèle (Qwen3.8-Flash-Next GGUF). Pascal/Volta CUDA 12.9, SYCL Arc Linux. HN ~906 pts / 13,5k stars — le « 100 T/s 4090 » est le titre Show HN. — https://github.com/Niko1221/Strata/releases/tag/v0.1.39
- **vLLM v0.31.0 : FlashMLA mega-attn défaut SM100, preload, quants MXFP4** — 5 oct. 06:44 UTC. 717 commits / 307 contributeurs. DeepSeek-V4.1-Flash : mega-attn + KV NVFP4. Breaking : kwargs multimodaux gated, tokenizer_mode=slow retiré. — https://github.com/vllm-project/vllm/releases/tag/v0.31.0
- **Quants 5 oct. : Kolibri-1 GGUF (patch requis) et Qwen3.8-Flash-Next abliterated** — Hob-forge / Prompt48 : Q4_K_M ~47,5 Go, pas d’imatrix ; stock llama.cpp v0.6.0 ne charge pas kolibri1. huihui-ai : série Swift, UD-Q4_K_XL ~111 Go / 4 shards, arch qwen4exp. — https://huggingface.co/Hob-forge/Kolibri-1-GGUF

## GPU
- **Ghost Core : boîtier sans écran à 3 499 $, seed 11 M$ mené par a16z** — TechCrunch, 5 octobre. Fondateur de 19 ans. RTX PRO 4000 SFF Blackwell 24 Go. Précommandes le jour même ; expédition dernière semaine d’octobre. — https://techcrunch.com/2026/10/05/at-19-ghost-founder-raises-11-million-to-build-a-3499-computer-for-your-personal-ai/
- **AMD Adrenalin dédié ROCm 10.1 : package 26.10.41.05, pas de RX 6000** — Notes AMD du 5 octobre. Driver compute séparé du gaming. Cartes RX 9000, AI PRO R9700 et RX 7900–7600. Win11 21H2+ / Win10 1809+. — https://www.amd.com/en/resources/support-articles/release-notes/RN-RAD-ROCM-10-01.html
- **RTX Spark vs Gorgon Halo : horizon mercredi 7 octobre, Microsoft + Jensen** — Tom’s (Jake Roach, paywall) : AMD sort des benches Gorgon Halo avant l’événement. Teaser NVIDIA/Microsoft « RTX Spark and new experiences ». Advanced Shader Delivery déjà live sur Gears E-Day. — https://www.tomshardware.com/pc-components/cpus/amd-attempts-to-get-ahead-of-expected-rtx-spark-launch-with-gorgon-halo-ai-benchmarks-company-says-it-has-shipped-over-half-a-million-agentic-pcs-to-date
- **GIGABYTE AI TOP 100 B850 : 5090 32 Go ou dual R9700, prix non publié** — Communiqué du 30 septembre, encore dans le filet VRAM du 5. Ryzen 9 9950X, 128 Go DDR5, 2 To, PSU 1 600 W. Deux SKU GPU. — https://www.gigabyte.com/press/news/2455
- **AWS : 68 Md$ de data centers bloqués, 1 Md$ pour les villes hôtes** — Tom’s, 5 octobre. Le CEO AWS dénonce ~100 bans proposés et un risque sur le lead IA US. Fin des pactes secrets ; 30 000 rétrofit logements. — https://www.tomshardware.com/tech-industry/artificial-intelligence/amazon-ends-secret-data-center-pacts-and-pledges-usd1-billion-to-host-towns-aws-promises-30-000-home-efficiency-retrofits-amid-100-proposed-bans

## Papiers
- **LOOM : une recette pour scaler les MoE loopés au-delà de deux boucles** — arXiv:2610.01153, MPI-IS. Variance des états cachés et collapse du routing traités ; scaling stable 9–12 loops. 1,7B à 9 loops : perplexité 9,62→7,77, zero-shot 42,4 %→47,7 %. — https://arxiv.org/abs/2610.01153
- **RSR : réécrire des trajectoires harnais-spécifiques pour un harness général** — arXiv:2610.02826, Tencent Hunyuan et al. Qwen-3.8-27B : 2 001 trajectoires → 11 094 pour SFT. Terminal-Bench 2 pass@3 57,0 %→74,2 % ; TB4 1,5 %→9,1 %. — https://arxiv.org/abs/2610.02826
- **VeriHarness : vérifier des tâches long-horizon sans gold ni rubrique** — arXiv:2610.00972, Google. Désaccord entre rollouts + challenger de consensus + outils d’évidence. +6,2 pts Gemini 3.5 Flash, +6,4 pts Claude Opus 4.8 vs un rollout. Pool ~26k rollouts, coût >100 k$. — https://arxiv.org/abs/2610.00972
- **HyperBrowseComp : stress test multilingue et multimodal pour agents web** — arXiv:2610.03574, MBZUAI. 423 questions manuelles, 13 langues, validées humainement. Preuves obscures, chaînes multi-étapes, vidéo / docs scannés / cartes. Filtre anti-connaissance paramétrique. — https://arxiv.org/abs/2610.03574
- **Pivot-SD : auto-distiller les dLM masqués sur les seuls pivots d’information** — arXiv:2610.03665. Offline, 200 questions × 4 rollouts. LLaDA-8B-Instruct bat SFT full-sequence et RL diffusion budget-matché en math/code. Oral EMNLP 2026. — https://arxiv.org/abs/2610.03665

## Analyses
- **Mollick : GPT-6 Pro sans pair, Custom GPT en voie de sortie, resets Pro illisibles** — 5 octobre. Trois posts produit OpenAI fusionnés : niche GPT-6 Pro vs Astra, extinction des Custom GPT en décembre, opacité des resets ChatGPT Pro. — https://x.com/emollick/status/2106993497697919431
- **Mollick : inbox humains+agents, OS personnel, et labs qui « attendent l’ASI »** — 5 octobre. Trois claims agents/politique : e-mail type Superhuman, primitives de sécurité pour co-travailler avec des IA, politique des labs réduite à l’attente de l’ASI. — https://x.com/emollick/status/2106995773682458784
- **LeCun à Wang : « Muse for Linux »** — 5 oct., 02:56 GMT. Reply X à Alexandr Wang qui liste ce que Muse a shipped (Mac, computer use, gadgets). Signal personnel, pas un post lab Meta. — https://x.com/ylecun/status/2106941621824524683
- **Huit ex-OpenAI, Anthropic et DeepMind sur leurs départs : relais WinBuzzer seulement** — 5 octobre. Entretiens Asterisk (Clara Collier), repris NY Mag. Thèmes affichés : course, usages militaires, recherche bridée (2023–sept. 2026). Texte primaire non ouvert. — https://winbuzzer.com/2026/10/05/why-ai-researchers-left-openai-anthropic-and-google-deepmind-xcxwbn/
- **Anthropic signale un « diary » Claude menaçant un sheriff de Floride ; inculpation felony** — Tom's Hardware, 5 oct. 09:40 UTC. Reviewers : conversation d’une femme de Floride visant le Lee County Sheriff’s Office. Au moins le 3e cas depuis août. — https://www.tomshardware.com/tech-industry/artificial-intelligence/anthropic-reports-florida-womans-claude-diary-threat-to-shoot-up-sheriffs-office-felony-charge-follows-its-at-least-the-third-such-conversation-to-reach-police-since-august

## Voix
- **OpenAI** (@OpenAI) — textGrain répond surtout à « ce texte a-t-il vraisemblablement été généré par un modèle OpenAI ? » ; il ne dit ni qui a écrit ni qui possède le texte. Souvent indétectable sur passages courts ; réécriture/traduction peut l’effacer. — https://x.com/OpenAI/status/2107164650249101695
- **Ethan Mollick** (@emollick) — GPT-6 Pro n’a toujours pas d’équivalent sur les tâches dures one-shot et la communication des résultats ; modèle spécialisé, distinct d’Astra, utile en travail parallèle. — https://x.com/emollick/status/2106993497697919431
- **Ethan Mollick** (@emollick) — Les Custom GPT disparaissent en décembre ; OpenAI propose une rampe vers un « plugin » privé. Les GPT étaient conçus pour être partagés — le bascule privée casse l’usage collectif. — https://x.com/emollick/status/2106958444196413670
- **Ethan Mollick** (@emollick) — Quote @angelbrodin : les resets et « banked resets » de ChatGPT Pro restent opaques hors Twitter ; le système de lots de tokens n’a de sens que pour une poignée d’initiés. — https://x.com/emollick/status/2106962963362111666
- **Ethan Mollick** (@emollick) — Inbox e-mail pensée humains et agents — style Superhuman, pas Slack : permissions adaptées, commentaires entre agents, escalade vers l’humain. — https://x.com/emollick/status/2106995773682458784
- **Ethan Mollick** (@emollick) — « OS personnel » pour co-travailler avec des IA ; quote Sriram Krishnan sur les primitives de sécurité (permissions fines, visibilité, agents d’audit). — https://x.com/emollick/status/2106936117421601110
- **Ethan Mollick** (@emollick) — La politique des labs, telle qu’il la lit, se ramène à « attendre l’ASI ». — https://x.com/emollick/status/2107203549059014739
- **Yann LeCun** (@ylecun) — Reply à Alexandr Wang (qui liste ce que Muse a shipped : Mac, computer use, gadgets) : « Muse for Linux ». Signal personnel, pas un post lab Meta. — https://x.com/ylecun/status/2106941621824524683
