Le patron d'Amazon Web Services a voulu répondre à la défiance très répandue à l'égard des data centers, rapporte TechCrunch. Amazon affirme de son côté ne plus recourir à des acco…
Un développeur raconte une revue de code récente : une PR d'environ 600 lignes générée, structurée et ouverte en moins de vingt minutes. Syntaxe propre, tests de base passés. Mais …
Une nouvelle catégorie de moteurs d'inférence très étroits émerge : Strata, ninfer, DwarfStar, Splash, llamAmpere ou gufo. Ils abandonnent volontairement la généralité qui fait la …
L'utilisateur MD_Reptile partage sur r/LocalLLaMA un rig assemblé avec du matériel de minage : trois RTX 3060 12 Go sur un châssis ouvert Kingwin 8x, une carte mère Asus Prime Z370…
Capcom se prépare à un futur où les jeux seront créés avec l'IA. Lors de la Capcom Open Conference RE: 2026, le programmeur Satoshi Ishida a donné une présentation intitulée « The …
Sopro 2610 est une mise à jour intermédiaire qui réduit les craquements et ruptures sur certaines voix clonées. Le modèle reste à 120M paramètres sous licence Apache-2.0, avec envi…
David Robinson, employé d'OpenAI sur les questions de sécurité, a quitté l'entreprise en affirmant que sa culture est « cassée ». Il reconnaît lui-même être « un peu un cliché » : …
Le roman C'était ça ou mourir de Thélyson Orélien a été accusé d'avoir été écrit à l'aide de l'intelligence artificielle. Cette polémique a soulevé des questions déontologiques et …
La Nvidia Shield TV Pro, le boîtier Android TV de Nvidia lancé en 2019, voit son prix grimper de 100 $. Le produit, lui, n'a pas vraiment changé en sept ans. L'explication avancée …
Un membre de r/LocalLLaMA a monté son propre serveur privé World of Warcraft et un client jouable gratuitement dans le navigateur, sur PC comme sur mobile. Il a créé un MCP et un h…
Splice est la plateforme d'échantillons sur laquelle s'appuient de nombreux producteurs pour leurs one-shots et boucles mélodiques. Sa CEO, Kakul Srivastava, estime que les e-mails…
David Robinson rédigeait les rapports de sécurité qui accompagnaient chaque sortie de modèle majeur chez OpenAI. Cette semaine, il a quitté son poste. Il prend désormais la parole …
Un post du forum r/LocalLLaMA illustre l'attente des utilisateurs limités à 8 Go de VRAM et 16 Go de RAM. Son auteur, u/RobustLokiX, espère un Qwen4 35B A3B ou un modèle équivalent…
Le moteur Kyojin, construit sur ExLlamaV3 pour Strix Halo (gfx1151, ROCm), fait tenir deux modèles MoE de classe 300B chacun sur une seule machine de 128 Go. Mesures sur Ryzen AI M…
Sur r/LocalLLaMA, un utilisateur s'agace des messages répétés qui affirment que Strata est désormais bon. Il affirme que des bots sont derrière cette vague et demande qu'elle cesse…
Numerama revient sur la semaine tech. Sony a annoncé l'upscaling QSSR pour la PS5, tandis que le jailbreak de la console est devenu plus simple que jamais. OpenAI a tenu sa grande …
Motorola prépare son retour au premier plan avec le Signature 27, un smartphone équipé de la nouvelle puce Snapdragon 8 Elite Extreme Gen 6. La marque met en avant la photo, l'IA, …
Et si l'IA menaçait la survie de l'humanité ? Cinq scénarios sont passés au crible. Une IA surpuissante pourrait poursuivre ses objectifs au mépris de la survie humaine, faciliter …
Un développeur publie Hillock, un projet open source qui remplace les bases vectorielles par SQLite et des hypervecteurs SIMD, sous 1,2 Go de VRAM. Il extrait des faits relationnel…
Deux références récentes du milieu de gamme sont en promotion à moins de 400 € : le Samsung Galaxy A37 et le Xiaomi Redmi Note 17 Pro 5G. Le comparatif de Frandroid oppose le suivi…
Boox poursuit la réduction du format de ses liseuses avec la Picco, équipée d'un écran de 3,97 pouces seulement. La petite machine mise sur la simplicité, des boutons physiques et …
Le Redmi Note 15 Pro n'est plus le dernier modèle de la gamme chez Xiaomi, mais il reste encore dans la course en 2026. À l'occasion du Local Day sur AliExpress, le smartphone est …
Sur r/LocalLLaMA, l'utilisateur zyxciss s'interroge : pourquoi les personnes qui font tourner leurs modèles en FP8 ou BF16 réagissent-elles avec autant d'horreur face à quelqu'un q…
Aleph Alpha met en ligne Kolibri-1 sur Hugging Face : 78 milliards de paramètres, dont 3,46 milliards actifs, sous licence Apache 2.0. Le modèle revendique un contexte allant jusqu…
Anyworld est un jeu d'aventure textuel multijoueur dans le navigateur, inspiré d'AI Dungeon 2. L'hôte fait tourner le modèle via llama.cpp (les API cloud type OpenAI sont aussi pri…
Un utilisateur de r/LocalLLaMA dit avoir abandonné un modèle 27B dense au profit de Qwen Flash, servi par Strata sur une Radeon 7900 XTX épaulée par 64 Go de DDR5. Il rapporte 60 t…
Lewis, de l'équipe post-training de Hugging Face, signe un long guide consacré à l'entraînement de modèles ouverts dans différents coding harnesses. La méthode s'appuie sur des bib…
Frandroid a testé le Xiaomi 18 Pro et l'iPhone 18 Pro côte à côte, sur un même terrain : la photographie. Les deux smartphones ont été utilisés pour multiplier les prises de vue, a…
La newsletter AINews de Latent Space résume la journée d'actualité IA en une ligne : « a quiet day ». Le titre original de la dépêche, « not much happened today », va dans le même …
La Ninja Luxe Café Mini est une machine à espresso semi-automatique compacte, équipée d'un broyeur intégré, d'une balance de précision et de conseils de mouture automatiques. Son o…
Volkswagen lance en Chine l'ID. Aura T6, un SUV électrique affiché à partir de 17 200 euros, soit deux fois moins cher qu'un Tesla Model Y. Le constructeur promet beaucoup d'espace…
Sur r/LocalLLaMA, un internaute demande ce que la communauté attend de Kimi K3.5. Il rappelle que Kimi K2 était déjà bon et que K2.5 a franchi un cap grâce à sa phase d'apprentissa…
Mercedes a retiré sa berline électrique EQE du marché américain, un signal qui invite à s'interroger sur l'avenir du modèle. Il n'annonce pourtant pas sa disparition : le construct…
Le portage non officiel de gufo sous Windows publie une bibliothèque pré-packagée : plus besoin de compiler, il suffit de télécharger l'archive .zip et de la décompresser. Un scrip…
Dans son récap pop culture hebdomadaire, Numerama revient sur trois actualités. CD Projekt Red conseille de désactiver l'option Nvidia HairWorks dans la version Remastered de The W…
Apple a annoncé le vendredi 2 octobre de nouveaux contrôles sur l'accès complet au disque de macOS, en désignant les agents IA comme principal danger. Ces garde-fous arrivent deux …
Un membre de r/LocalLLaMA voulait consacrer un mini-PC AliExpress à un nœud RAG/search pour Qwen3.8 27B. Annoncé avec un Intel N150 et de la DDR4/DDR5, il arrive avec un Core i3-70…
NousResearch a publié une nouvelle build canary de Hermes Agent, identifiée par le tag v0.21.4+canary.20261003T070620Z, sur la page des releases GitHub du projet. Le canal canary c…
Nvidia et SoftBank ont versé le 1er octobre 2026 leurs dernières tranches de 10 milliards de dollars (environ 9 milliards d'euros) chacune à OpenAI. Ces paiements soldent la levée …
Liquid AI met en ligne deux encodeurs multilingues, LFM2.5-Encoder-250M et 350M, bâtis sur l'architecture LFM2. Ce sont des modèles de langue masqués à attention entièrement bidire…
Un utilisateur de r/LocalLLaMA fait tourner Qwen3.8-Flash-Next 177B en quantification UD-IQ3_XXS avec llama.cpp sur Windows, via un système de streaming d'experts. Sur une RTX 5070…
La Tesla Model 3 restylée, lancée en 2023, s'apprête à recevoir une mise à jour pour rester dans la course. La berline électrique gagnera un écran plus grand, assorti d'options de …
Une pull request ouverte sur le dépôt ggml-org/llama.cpp propose de réduire de moitié la mémoire occupée par les scores de l'indexeur. Elle porte le numéro 29825 et est signée Serv…
Un membre du subreddit r/LocalLLaMA partage les performances d'une variante quantifiée en Q6 d'un modèle Qwen3.6-35B-A3B, diffusée sous le nom gufo-Qwen3.6-35B-A3B-Q6dense. Les chi…
BMW s'apprête à attaquer le segment C électrique avec l'i1, une déclinaison à batterie de la Série 1. Ce modèle deviendra le véhicule électrique le moins cher de la marque. Il repr…
POCO propose une offre sur sa tablette Pad M1, l'un des modèles les plus vendus sur le marché français. Elle s'adresse à ceux qui cherchent une tablette pour le quotidien sans dépe…
Le OnePlus 15 se vend en grandes quantités, porté par un rapport qualité-prix que 01net qualifie d'imbattable. Le smartphone, décrit comme ultra puissant, rivalise selon le site av…
Un utilisateur de r/LocalLLaMA se lance dans la construction d'un assistant vocal entièrement hors ligne, exécuté en local sur un mini PC fanless : Celeron J6412 quatre cœurs, 16 G…
OpenClaw publie sa version 2026.9.8, qui rassemble 58 commits, 43 pull requests et 21 contributeurs. Particularité de cette sortie : les notes de version et le changelog proposent …
Sur r/LocalLLaMA, un utilisateur observe que les modèles récents, ouverts comme fermés, partagent un style d'écriture de plus en plus dense en information et au vocabulaire élargi.…
Un développeur publie mlsubgen, un outil qui génère des sous-titres en 45 langues entièrement en local, sous Linux et avec un GPU NVIDIA. Contrairement aux wrappers Whisper habitue…
Sur r/LocalLLaMA, un utilisateur rapporte que les poids IQ3_XXS de Strata + Qwen3.8 Next, tout juste sous 80 Go, tournent entre 45 et 70 tokens/s sur sa machine DDR4 couplée à une …
Un internaute publie sur r/LocalLLaMA un court message au ton plaisant : « Les mines ont été dures avec toi », écrit-il, avant d'assurer que du maquillage et de nouveaux ventilateu…
Unitree Robotics présente UnifoLM-WLA-1.0, un modèle de fondation humanoïde de 6B paramètres entraîné sur environ 2 500 heures de données issues de robots réels. Un seul modèle cou…
Sur r/LocalLLaMA, l'utilisateur JLeonsarmiento demande si la communauté doit tourner la page de la hype de la semaine écoulée ou si des membres ont des cas de réussite à partager p…
OpenClaw publie la version 2026.9.8, référencée sur le dépôt GitHub du projet sous l'étiquette v2026.9.8. La publication est datée du 2 octobre 2026. Les notes accompagnant cette v…
Juste avant les tourniquets de la station de métro Grand Army Plaza, à l'extrémité nord du Prospect Park, à Brooklyn, un ancien kiosque à journaux est désormais tenu par un dinosau…
Un internaute raconte sur r/LocalLLaMA avoir obtenu un financement pour un petit labo d'IA au sein d'un établissement public d'enseignement supérieur en Irlande, l'équivalent d'un …
Un développeur a passé onze mois, soirs et week-ends, à construire Peacebell, un petit modèle de langage spécialisé sur la Seconde Guerre mondiale, doté d'un pipeline d'entraînemen…
Après trois semaines de tests, un utilisateur a fait passer trois checkpoints Qwen3.8 dans les mêmes dix épreuves sur une RTX PRO 6000 : RadixArk/Qwen3.8-27B-NVFP4 (dense), orcarou…
Selon un post publié le 2 octobre 2026 sur r/LocalLLaMA, l'achat d'une RTX 5090 chez le revendeur Micro Center serait désormais soumis à des formalités, dont une déclaration de non…
AMD a publié une mise à jour du système d'exploitation de sa Ryzen AI Developer Platform. Cette nouvelle version embarque ROCm 10.0 ainsi que Linux 7.2. L'information a été relayée…
La version 2.1.288 de Claude Code apporte plusieurs ajustements d'usage. Un prompt effacé par Ctrl+C peut désormais être restauré en pressant la flèche haut sur un champ vide, text…
Microsoft met en ligne FrogNano-4B-2609, un modèle agentique pour GPU modestes. Dérivé de Qwen3.5-4B, il reprend son architecture dense à 32 couches, mais son post-entraînement, te…
Apple s'apprête à restreindre l'accès complet au disque (« full disk access ») sur Mac, en réponse aux risques que font peser les agents IA. Dans une mise à jour publiée vendredi, …
Sur r/LocalLLaMA, l'utilisateur basnijholt écrit que faire tourner ses propres modèles d'IA ne revient pas moins cher. Il le fait quand même, notamment pour la confidentialité : il…
Un nouveau benchmark, SWE-sweep, propose de confier à un agent un large dépôt de code pour qu'il trouve et corrige un maximum de bugs par lui-même. Le score repose sur un ensemble …
Dans une analyse publiée le 29 septembre, Anthropic évalue le modèle chinois GLM-5.3, souligne les dangers qu'il présente et met en avant des résultats techniques préoccupants. L'e…
Un LoRA pour Qwen3.8-27B fait parler le modèle comme une personne plutôt qu'un assistant : 700 votes, 248 commentaires et 44 000 téléchargements. Les critiques pointaient des répon…
Réservée à la PS5 Pro depuis deux ans, la mise à l'échelle par intelligence artificielle arrive sur la PS5 de base, six ans après la sortie de la console. Deux jeux en profitent dé…
Le Ryzen 7 9800X3D, processeur AMD haut de gamme, est proposé à un tarif qui défie toute concurrence. Il ne s'agit pas d'une erreur de prix : le composant est neuf et garanti par A…
Le pape Léon XIV critique l'art produit par les machines, en y voyant une différence « ontologique, avant même qu'esthétique » avec l'art humain. Une machine, rappelle-t-il, génère…
Sur r/LocalLLaMA, un utilisateur rapporte avoir fait tourner Strata sur une 5090 limitée en puissance, épaulée par 96 Go de DDR5-6400. Le modèle Qwen3.8-Flash-Next est servi en qua…
Selon le magazine Time, Donald Trump a passé des heures à interroger Grok, le chatbot d'Elon Musk, en décembre 2025. Il lui a notamment demandé comment les Vénézuéliens réagiraient…
L'Alpine A390 GTS, premier modèle équipé des batteries de la start-up française Verkor, a mis entre 41 et 55 minutes à se recharger lors d'un essai mené par Challenges, quand Alpin…
D'après Latent Space, Ahmad Al-Dahle, qui a dirigé les modèles Llama chez Meta, travaille désormais chez Airbnb pour y déployer l'IA. L'effort couvre deux volets : la façon dont le…
Le forum r/LocalLLaMA, dédié aux modèles exécutés en local, relaie une nouveauté dans llama.cpp baptisée « Decision Models ». Le message, publié le 2 octobre 2026 par l'utilisateur…
D'après le magazine Time, Donald Trump a demandé à Grok, le chatbot d'Elon Musk, comment les Vénézuéliens réagiraient à une capture de Nicolás Maduro. La consultation remonte à déc…
OpenClaw publie la 2026.8.35, une version « extended-stable » limitée à la passerelle, son équivalent actuel du LTS. Elle reprend l'état de fin août 2026 et ajoute le support du mo…
Sur r/LocalLLaMA, un utilisateur demande des conseils pour faire évoluer sa configuration : Ryzen 5600X, Radeon 7900XTX et 64 Go de DDR4. Il fait tourner Qwen 3.8 27B en quantifica…
Anthropic, le créateur de Claude, ferait son entrée en Bourse avant la fin de l'année. L'entreprise est présentée comme un nouveau géant de la tech à 2 000 milliards de dollars. L'…
Ce 2 octobre est le dernier jour pour réserver une table d'exposition au TechCrunch Disrupt 2026. Du 13 au 15 octobre, plus de 10 000 fondateurs, investisseurs, opérateurs et dirig…
Pour un budget très limité, la Honor Pad X8a est proposée sur AliExpress avec une remise de 63 %. Son prix descend ainsi sous la barre des 90 euros. Le modèle est présenté comme en…
Un utilisateur a publié sur Hugging Face une version quantifiée, abliterated et ajustée de Qwen3.8-27B Coder, en IQ4_XS avec imatrix pour 18,35 Go, pensée pour remplir une seule ca…
Microsoft va étendre son Advanced Shader Delivery à toutes les cartes graphiques Nvidia RTX avant la fin du mois d'octobre 2026. Jusqu'ici, seuls les GPU AMD et les puces Snapdrago…
D'après Maddyness, les start-up de la French Tech ont levé 59 millions d'euros cette semaine. Près de 90 % de ces fonds sont allés à des entreprises liées à l'IA. Le chiffre illust…
Les trottinettes électriques restent un moyen efficace de se déplacer d'un point à un autre sans devoir démarrer la voiture. Le modèle Todimart T3, annoncé à 25 km/h et vendu 92 €,…
Tesla a équipé toutes les Model 3 vendues en Chine d'un écran de 16 pouces, de nouvelles jantes et d'une fonction d'alimentation d'appareils électriques jusqu'à 2,2 kW. Les États-U…
Un membre de r/LocalLLaMA publie un quant low-bit du modèle base Qwen 3.8 Flash, pensé pour tourner sur un seul Spark. Selon l'auteur, ce quant conserve 95 % de la précision b16 et…
Lancés le 29 septembre, les Dots d'OpenAI assemblent des capacités déjà existantes — ChatGPT agent, tâches programmées, Pulse, workspace agents — sous une persona d'assistant. Le c…
Sur r/LocalLLaMA, un utilisateur fait tourner Qwen3.8-Flash-Next sur une seule carte R9700, en exl3 5.05 bpw et avec le fork ROCm d'exllamav3. Il place 112 des 512 experts de chaqu…
D'après le magazine Time, Donald Trump a demandé à Grok, le chatbot d'Elon Musk, comment les Vénézuéliens réagiraient à la capture de Nicolás Maduro. La question aurait été posée e…
La pull request #29818, signée ngxson, ajoute une API /v1/systemone au serveur de ggml-org/llama.cpp. Elle concerne cinq modèles : laya, julia-1, lev, openjev et kev. Leurs version…
Samsung a relevé le prix de presque tous ses Galaxy A sur sa boutique française, avec des hausses allant de 10 à 70 euros par rapport aux tarifs de lancement. Le Galaxy A17 5G, le …
La société Earendil a publié le 1er octobre la première version stable de Pi, un agent d'IA open source qui a fait sensation sur Hacker News. L'agent entend tenir tête à Claude Cod…
Sur r/LocalLLaMA, un utilisateur demande si Mistral prévoit de nouvelles sorties de modèles. Il souligne qu'un long moment s'est écoulé depuis les derniers, et remarque que l'entre…
Au Thales Cyber Summit du 1er octobre, Patrice Caine, PDG du groupe, a fixé la ligne directrice face à l'IA : « l'humain doit garder le contrôle ». Une formule qu'il juge plus adap…
Suno, connu pour ses outils de création musicale par IA, élargit son offre avec une fonction de génération de voix parlées. À partir d'un script ou d'une simple description textuel…
Sur r/LocalLLaMA, un utilisateur raconte avoir vu des personnes générer des vidéos avec Opus 5.5, puis avoir tenté la même chose avec des modèles gratuits. Selon lui, muse spark 1.…
Un utilisateur rapporte que Claude desktop ne parvient plus à créer des issues GitHub. Il s'en servait pour discuter de fonctionnalités ou de bugs, puis générer l'issue à partir de…