L'Alpine A390 GTS, premier modèle équipé des batteries de la start-up française Verkor, a mis entre 41 et 55 minutes à se recharger lors d'un essai mené par Challenges, quand Alpin…
Sur r/ClaudeAI, un utilisateur pose une question qu'il dit sincère : pourquoi Claude répond-il par une version approximative de ce qui lui est demandé, en proposant de faire mieux …
Des pirates ont créé un faux modèle baptisé « Plus 5.6 », hébergé sur le vrai site chatgpt.com. Ils l'ont promu par des publicités Google pour faire installer un cheval de Troie su…
Sur r/ClaudeAI, un utilisateur raconte que les longs pavés de texte produits par son Opus 5.5 lui faisaient perdre des informations importantes. Ni les listes numérotées ni les con…
Le Poco X8 Pro Max en version 512 Go est proposé à 350 euros sur AliExpress, alors que le modèle 256 Go se vend toujours 499 euros sur le site officiel. L'appareil est vendu avec g…
Sur r/LocalLLaMA, un utilisateur cherche des modèles locaux de moins de 40B pour remplacer Qwen et DeepSeek, dont les modèles chinois sont interdits sur son lieu de travail. Deux u…
Micron et Samsung alertent : la pénurie de mémoire ne va pas se régler tout de suite. L'IA et les serveurs absorbent une part croissante de la production, ce qui laisse moins de pl…
Tavus a présenté ce jeudi 1er octobre une IA capable de dialoguer en visioconférence et de réagir aux gestes comme aux silences. Dans un test mené par l'entreprise, près de la moit…
ChatGPT ajoute une fonction de cabine d'essayage virtuelle. L'assistant d'OpenAI permet désormais à ses utilisateurs de visualiser une tenue sur eux à partir de simples photos, ava…
Sur r/LocalLLaMA, un utilisateur rapporte avoir vu Deepseek partir dans une boucle de raisonnement infinie sur deux ou trois tokens précis. Il se demande s'il s'agit d'un comportem…
Frandroid a testé les AirPods 5, qui reprennent la réduction de bruit active déjà présente sur les AirPods 4, une prouesse sur des écouteurs ouverts. Apple propose cette technologi…
Microsoft a lancé ce jeudi 1er octobre MAI-Transcribe-2-Streaming, un modèle d'IA qui transcrit la parole en direct dans 60 langues. L'entreprise l'accompagne de deux nouveaux modè…
Le modèle Ling-3.1-flash fait son entrée à la deuxième place de la Mobile App Arena de Design Arena, dans la catégorie des modèles à poids ouverts. L'auteur du post publié sur r/Lo…
Sur r/LocalLLaMA, l'utilisateur jwhh91 présente pilgrim.farm, une radio dont la musique, les voix et les effets sonores loufoques sont produits par trois modèles locaux. Le tout to…
Le forum r/LocalLLaMA relaie Perplexity Decider 27B, un modèle de décision à poids ouverts. Il s'agit d'un affinage de Qwen3.8 27B, annoncé par l'utilisateur u/rm-rf-rm. Les poids …
OpenClaw publie la 2026.8.34, une « extended-stable », l'équivalent actuel du LTS. Elle reprend l'état du projet fin août 2026, avec les correctifs de sécurité critiques, des corre…
Le projet Pi atteint la version 1.0, selon une annonce publiée le 2 octobre 2026 sur le forum r/LocalLLaMA. Le support de MCP est désormais inclus par défaut dans cette version. La…
Le dépôt OpenClaw a publié le 1er octobre 2026, à 23h36 UTC, une entrée de release sur GitHub intitulée release-publish/bd058c2d9999-1790897806. La note décrit un correctif (« fix …
OpenClaw a poussé un correctif sur son canal de publication de versions. Ce correctif concerne la vérification de la propriété des chunks publiés au format hérité. Il porte la réfé…
Un utilisateur de r/LocalLLaMA a testé Gufo 0.4.0 via son image podman, sur Qwen3.8 27B en Q4, avec le modèle de draft DFlash2 et le script de benchmark fourni par le projet. Il a …
OpenClaw a publié un correctif intitulé « resume delayed npm readback », référencé sous le numéro #162990. La modification porte sur la chaîne de publication du projet, et plus pré…
Sur r/LocalLLaMA, un internaute constate un essor des projets de decomp et recomp de jeux portés par l'IA, visibles selon lui sur les subreddits r/decomps et r/recomps, qui s'appui…
Un utilisateur de r/LocalLLaMA a comparé deux machines louées sur Vast.ai pour du pré-entraînement : l'une en DDR4/PCIe4 (EPYC 7352, 192 Go de RAM, 26,3 Go/s), l'autre en DDR5/PCIe…
Un développeur publie Slipstream, un moteur d'inférence C++ Metal compilé pour Apple Silicon, avec streaming d'experts depuis le SSD et drafting spéculatif. Ce checkpoint Qwen3.8-F…
Un nouveau modèle, proposé en gratuit ou en essai, est apparu sur OC. Aucun détail n'a encore été communiqué à son sujet. Sur r/LocalLLaMA, l'auteur de la publication se demande qu…
La version 2.1.287 de Claude Code introduit les Claude Mods : les plugins peuvent désormais modifier plus profondément le comportement de l'outil. Elle ajoute « You should know », …
Sur r/LocalLLaMA, un utilisateur cherche des recommandations pour une version non censurée du modèle Ornith1.5-9B. Toutes celles qu'il a essayées, selon lui, échouent à des tests b…
Sur r/LocalLLaMA, un utilisateur équipé d'une 5060 Ti 16 Go, d'un Ryzen 9600x et de 16 Go de RAM système cherche le meilleur réglage pour faire tourner Qwen3.8 27B. Il vise au moin…
Un juge fédéral américain a rejeté deux recours antitrust déposés contre Google. Ils venaient de Chegg et de Penske Media Corporation, la maison mère de Rolling Stone, qui reprocha…
Un utilisateur de r/LocalLLaMA détaille les performances d'un serveur huit V100 acheté 5 400 dollars sur eBay, mis en route avec l'aide d'Opus 5.5. Avec seulement quatre GPU, il ob…
Un passionné fait tourner un chat et de la génération d'images sur un Tandy 1000 TL/3, une machine DOS à processeur 286. Le programme natif DeskMind passe par WiFi (carte PicoMEM 2…
La pull request #29761 du dépôt ggml-org/llama.cpp, signée am17an, ajoute le support du MTP pour Qwen Flash Next. Elle a été fusionnée après 17 heures de développement. Des quants …
Un utilisateur de r/LocalLLaMA a publié sur GitHub un dépôt de ressources vLLM destiné aux configurations à deux GPU Nvidia. Il explique avoir voulu pousser son PC le plus loin pos…
Un utilisateur de r/LocalLLaMA raconte avoir passé 12 heures avec Ling 3.1 Flash, un modèle 560B A25B annoncé comme « coming soon », pour réaliser « l'instrument le plus difficile …
Un utilisateur de r/LocalLLaMA cherche une alternative open source à Claude Cowork, avec intégrations type Notion ou Gmail, recherche web et création de PDF. Il a repéré le projet …
Le gouvernement américain confie la sécurité de l'IA à ceux qui la développent, balayant les discours alarmistes. Donald Trump a réuni Dario Amodei, Greg Brockman, Sundar Pichai, M…
Les travaux sur MTP avec Qwen Flash Next et llama.cpp ont redémarré. Des quants GGUF sont publiés sur le dépôt ggml-org de Hugging Face, sous le nom Qwen3.8-Flash-Next-GGUF, et une…
Sur r/LocalLLaMA, un utilisateur détaille sa configuration : quatre Tesla T4 de 16 Go, soit 64 Go de VRAM, sur une carte mère SuperMicro X11SPA-T avec un Xeon W3225 et 768 Go de DD…
Astrabox est une interface d'arcade open source : on décrit un jeu, l'IA le construit, puis on demande des changements à la voix pendant la partie. Chaque jeu a ses visuels et son …
Grokipedia, le concurrent de Wikipédia propulsé par l'IA de SpaceXAI, a reçu une mise à jour v0.3. Elle apporte un nouveau logo ainsi qu'une refonte de sa page d'accueil et de sa p…
Sur le forum r/LocalLLaMA, une publication intitulée « AI CEO Interviews (2026) » a été mise en ligne le 30 septembre 2026. Elle est soumise par l'utilisateur LambdaHominem. L'extr…
Un membre de r/LocalLLaMA a compilé un classement de GPU assez récents dotés de 32 Go de VRAM, du moins cher au plus cher, tous sous les 1600 $. Les prix proviennent d'annonces eBa…
Sur r/LocalLLaMA, un développeur cherche le meilleur modèle local pour Blender et le game dev. Il constate que même les modèles les plus performants qu'il a testés, GLM5.3 Flash et…
Deux fine-tunes de Qwen Flash Next sortent du labo : Victoria, orientée code et agents, voit ses experts réduits de 44 % (de 512 à 288 par couche) via la technique REAP, puis est r…
Un utilisateur de r/LocalLLaMA compare deux quantifications de Qwen3.8-27B : Dirk-Qwen 3.8-27B et Swift-1.5 d'UkisAI. Il les évalue sur sa propre batterie de questions : code, nump…
Simon Willison a visité le Museum of the City of New York, où il a vu « He Built This City: Joe Macken's Model ». Il s'agit d'une maquette de la ville de 50 x 27 pieds, construite …
Un utilisateur de r/LocalLLaMA fait tourner Qwen Flash, et même un Qwen 27B dense, sur une 7900 XTX associée à un 9800X3D. En comptant son électricité à 0,25 € le kWh — de 0,11 € à…
Test sur Mac Studio M5 Ultra 256 Go : Qwen3.8-Flash-Next (oMLX) face à Laguna-S-2.1 GGUF (LM Studio), contexte plafonné à 262K et aucun token en cache. Qwen tient environ 4 200 tok…
Flow Engineering, qui applique les agents IA à la conception de matériel, lève des fonds sur une valorisation de 750 millions de dollars. Valor, Atreides et Sequoia figurent parmi …
L'équipe Index LLM de BiliBili partage Index-Translate, un modèle de traduction couvrant 150 langues, en versions 2B, 9B et 35B-A3B (preview). On peut y préciser terminologie, styl…
Le projet llama-halo-hybrid, mis à jour après deux mois d'expérimentation sur Strix Halo, combine un GPU R9700 et l'APU : parties denses du modèle, KV et certaines couches sur le G…
Framework a ouvert les précommandes de son Desktop, en édition DIY, équipé d'un processeur AMD Ryzen AI Max 400 Series et de 192 Go de mémoire. L'information a été relayée sur le f…
Sur r/LocalLLaMA, un utilisateur qui veut acheter deux DGX Spark explique ne trouver aucun vendeur. Il rapporte une hausse de prix d'environ 2 000 dollars en une semaine. Un Microc…
La version 2.1.286 de Claude Code ajoute un compteur du type « 2 of 5 » à l'invite de permission lorsque plusieurs demandes s'empilent, et le support de la souris sur les lignes « …
OpenAI présente une « Decisions API », décrite comme un clone de Jev, d'après TechCrunch. Cet outil pourrait aider le laboratoire à stopper ses agents fonctionnant en essaim. Il co…
Le projet FastFlowLM permet désormais d'exécuter le modèle Qwen 3.8 27B sur les NPU AMD, selon un signalement publié sur r/LocalLLaMA le 30 septembre 2026. La vitesse de décodage a…
ElevenLabs, start-up d'IA vocale, double sa valorisation pour atteindre 22 milliards de dollars. Le rachat d'actions réservé aux salariés, d'un montant de 300 millions de dollars, …
L'IA a largement conquis les téléphones et les ordinateurs, mais elle a échoué dans les appareils dédiés. Meta et OpenAI comptent changer la donne dans l'année à venir. Les deux en…
Le laboratoire chinois Ling dévoile Ling-3.1-flash, un modèle d'environ 560 milliards de paramètres dont 25 milliards activés par token, avec un contexte allant jusqu'à 1 million d…
Un article relayé sur Hacker News rapporte qu'un nouvel agent IA de Meta aurait constitué des listes de personnes appartenant à des groupes vulnérables, simplement sur demande. La …
OpenAI annonce avoir déjoué une campagne coordonnée visant à extraire le raisonnement de ses modèles protégés. L'entreprise indique renforcer ses défenses contre la distillation ad…
Reddit met fin au support des flux RSS et à l'accès public à son API. La plateforme invoque les bots IA pour justifier cette fermeture, et poursuit ainsi le resserrement de l'accès…
Sur r/ClaudeAI, un utilisateur a demandé à Claude Opus 5.5 de construire de bout en bout un jeu de frappe, à partir d'un seul prompt. Le résultat : un site gratuit et responsive, a…
Le modèle Ling-3.1-flash affiche environ 560 milliards de paramètres au total, dont seuls 25 milliards sont activés par token, avec un contexte allant jusqu'à 1 million de tokens. …
Sur le forum r/LocalLLaMA, un fil publié le 30 septembre 2026 demande de quoi a parlé une réunion de dirigeants de la tech à la Maison-Blanche, qualifiée par son auteur de « réunio…
Sur r/LocalLLaMA, un utilisateur cherche où apprendre en profondeur le fine-tuning de modèles locaux avant de dépenser de l'argent. Il cite RL, RL LoRA, QLoRA ou CPT LoRA, juge les…
Sortie d'ATX-Swift-1.5-Qwen3.8-27B-Uncensored-MTP, un modèle de 27B quantifié en i1-Q5_K_M qui tiendrait 50 à 65 tokens/s sur toute sa fenêtre de 131 072 tokens, sur une seule RTX …
Sur r/LocalLLaMA, un utilisateur compare Tiel Coder 35B A3B de Peculiar Ragdoll aux quantifications existantes d'Ornith 1.5 35B A3B. Tiel Coder correspond en réalité à Ornith 1.5 3…
Sur r/LocalLLaMA, l'utilisateur jjusko20 donne des nouvelles de son fine-tune du modèle Yandex/AliceAI 80B-A3B : environ 40 % du travail initial est terminé. Il publie sa courbe de…
Meta rejette la version d'un journaliste, qui affirme que son agent IA Muse a lu ses messages privés alors que le réglage Mac requis était désactivé. Le groupe assure que Muse ne p…
Un utilisateur du subreddit r/ClaudeAI, /u/DeathNote_928, affirme dans le titre de son message que Claude l'a identifié dix fois en une journée comme un « risque de biosécurité ». …
Un journaliste de Frandroid a généré sa propre application pour l'écran arrière du Xiaomi 18 Pro à l'aide de l'IA. Selon lui, l'opération ne prend que cinq minutes, et il détaille …
L'utilisateur anabology a publié sur X le résultat d'une expérience menée avec Claude Opus 5.5 : il a fourni au modèle le prompt publié par Donald Jewkes, Midjourney et un moodboar…
Un développeur raconte sur r/ClaudeAI avoir déplacé l'extraction de champs, toujours identiques et faciles à valider, vers un modèle moins cher, en gardant Claude pour les entrées …
Un développeur qui construit des agents sur l'API de Claude critique les outils de mémoire actuels, qu'il résume à des bases vectorielles avec une surcouche. Il rapporte qu'un util…
Un utilisateur a confronté les deux modèles sur un même prompt : un clavier en acrylique transparent qui se construit touche par touche en Three.js. GPT 6.1 Sol a fini en 11 minute…
Un utilisateur de Reddit dit avoir réalisé un court-métrage animé en connectant Claude au MCP de Magnific. Presque tout le travail s'est fait dans Claude, grâce à une compétence Se…
Hugging Face met en ligne l'Open TTS Leaderboard, un classement ouvert consacré à la synthèse vocale multilingue et au clonage de voix. Le projet vise une évaluation à grande échel…
En présence des principaux acteurs américains de l'IA, Donald Trump a présenté un code de bonne conduite destiné à encadrer le développement du secteur. Le texte prévoit quatre niv…
À TechCrunch Disrupt 2026, Andrew Feldman, PDG et cofondateur de Cerebras Systems, viendra parler du besoin croissant de calcul, d'énergie et d'infrastructure. Il expliquera commen…
Instagram devient la dernière plateforme sociale à intégrer des fonctions IA directement dans ses outils, avec des retours sur les publications des utilisateurs. L'entreprise a ann…
La startup Restate annonce une levée de fonds de 20 millions de dollars. Elle a été fondée par des anciens d'Apache Flink et s'attaque au spécialiste des workflows Temporal. Son po…
Il ne reste que trois jours pour s'inscrire comme exposant à TechCrunch Disrupt 2026. La date limite est fixée au 2 octobre à 23 h 59, heure du Pacifique. L'événement promet de met…
Sur le forum r/LocalLLaMA, un utilisateur demande s'il existe un modèle ou un outil capable de détecter un texte rédigé par une IA en s'exécutant en local sur sa machine. Il précis…
Selon l'OMS, l'Europe pourrait manquer de 4,1 millions de professionnels de santé en 2030, dont 2,3 millions d'infirmiers et 600 000 médecins. La robotique est perçue comme une rép…
Anthropic a lancé cette semaine Sonnet 5.5, un modèle présenté comme plus abordable. Ses performances restent proches de celles de Claude Opus 5.5, selon l'éditeur. Surtout, ce nou…
Dans la nuit du 29 au 30 septembre, le président américain a signé un décret imposant le terme « Super Intelligence » à son administration. La décision a fait exploser les enregist…
Au DevDay, OpenAI a annoncé des agents capables de travailler en continu, un nouveau modèle moins coûteux, une inférence accélérée et une évolution de Codex. S'y ajoutent un espace…
Officialisée en août dernier, la série Sony Bravia 6 regroupe les TV OLED les plus abordables de la gamme Bravia du constructeur japonais. Le modèle de 55 pouces est actuellement p…
Le dépôt ggml-org/llama.cpp a reçu un commit ajoutant la prise en charge de GLM-5.3-Flash, également désigné sous le nom GLM5-Next (pull request #27773). llama.cpp est l'un des mot…
Tensorfold, moteur d'inférence open source, atteint 40 à 60 tokens/s avec Qwen3.8-27B sur un Mac mini M5 Pro, via le modèle Vontra/Qwen3.8-27B-MLX-4bit et un modèle de drafting. L'…
Sur r/LocalLLaMA, un utilisateur demande des recommandations d'outils de coordination et de messagerie pour faire collaborer plusieurs agents sur des problèmes difficiles. Il aimer…
Un utilisateur de r/LocalLLaMA raconte que son nouveau logement subit des coupures de courant fréquentes : trois en une semaine, avec extinction de son PC. Sa machine embarque deux…
Dans un article publié le 30 septembre 2026, Maddyness pose un constat : l'adoption de l'IA ne constitue qu'une étape. Selon le média, le véritable chantier commence ensuite, avec …
Selon un post publié sur le forum r/LocalLLaMA, DeepSeek entraîne désormais ses modèles sur Ascend 950. Le changement est mis en regard d'une déclaration de Liang Wenfeng, formulée…
Un utilisateur de r/LocalLLaMA rapporte que son serveur llama-server, utilisé avec Pi, se bloque parfois après un appel d'outil. Les journaux le croient terminé alors que Pi attend…
Faire tourner un modèle en local est la partie facile : les fuites viennent des briques tierces ajoutées autour. Un appel HTTP vers une API cloud, un juge hébergé pour les évals, u…
Hermes Agent, le projet d'agents de NousResearch, a publié le 30 septembre 2026 une nouvelle build canari, taguée v0.21.4+canary.20260930T070235Z. Une version canari désigne une bu…
Dans un article publié le 30 septembre 2026, Maddyness se penche sur l'IA appliquée à la santé. Le média y annonce un sujet sur la manière de transformer le savoir médical en meill…
Maddyness consacre un article à l'usage de l'IA dans la santé, sous le titre « Santé à l'ère de l'IA : transformer le savoir médical en meilleurs soins ». L'angle annoncé : convert…