À partir du 9 octobre, les comptes gratuits de Gemini n'auront plus accès qu'à un seul modèle, et ce ne sera pas le plus puissant. L'IA à volonté, c'est donc terminé pour ces utili…
Un utilisateur fait tourner Qwen Flash Next Q4 sur un Mac mini M5 de 64 Go. Faute de place, les experts sont gardés en cache chaud et le reste est streamé depuis le SSD. Il obtient…
Un utilisateur de r/LocalLLaMA publie un benchmark et un classement (airbench.ai) qui mesurent la réussite et la vitesse de couples harnais/modèle sur des tâches réelles : calcul, …
Sept chercheurs de Google présentent SAFE, une équipe d'agents IA chargée d'enquêter sur les chaînes qui inondent les plateformes vidéo de « AI slop ». YouTube est cité comme la pl…
Selon Bloomberg, la situation de Siri AI en Europe ne serait pas près de s'améliorer. Apple utiliserait son intelligence artificielle comme moyen de pression sur la Commission euro…
Mi-liseuse, mi-carnet de notes numérique, la Kindle Scribe de 2024 reste un modèle haut de gamme recommandable en 2026, malgré l'arrivée récente de sa successeure. Amazon affiche a…
Maddyness publie un article consacré aux solopreneurs et à la façon dont l'IA agentique change les règles de l'entrepreneuriat. Le sujet porte sur les entrepreneurs qui travaillent…
Capcom veut faire évoluer progressivement son moteur maison pour faciliter le développement de ses prochains jeux. L'éditeur prévoit d'y intégrer plusieurs outils d'intelligence ar…
Le modèle Kolibri 78B d'Aleph Alpha est désormais accessible gratuitement en ligne, via une interface de chat dédiée. L'information a été relayée sur le subreddit LocalLLaMA, après…
Après avoir équipé ses Model 3 et Model Y de phares matriciels, Tesla corrige désormais automatiquement l'inclinaison des feux de croisement de certaines de ses voitures électrique…
Google a suspendu les soumissions de son programme de récompenses consacré aux failles présentes dans ses logiciels open source. Le géant a été submergé par des rapports générés au…
Yann LeCun mise sur la confiance dans les humains et les institutions, tout en renforçant les protections techniques par ses recherches. Mais les précédents industriels montrent qu…
Le 5 octobre 2026, l'AMRO — Bureau de recherche macroéconomique de l'ASEAN+3, créé en 2011 par les ministres des finances de la zone — a publié son rapport 2026 sur la stabilité fi…
Un développeur publie DecisionTune 1.0, un modèle de décision de 395M sous licence Apache-2.0 : à partir d'un état, d'une question et d'une liste d'options, une passe d'encodeur re…
En Californie, l'enseigne américaine Micro Center réclame désormais la signature de ce qui ressemble beaucoup à une déclaration sur l'honneur pour acheter une RTX 5090. La mesure v…
Le Pixel 10a, le smartphone de Google, voit sa version 128 Go perdre quasiment 40 % de son prix dans le cadre d'une offre spéciale sur AliExpress. Quelques mois après sa mise en di…
Elon Musk a annoncé le 4 octobre 2026 vouloir rebaptiser SpaceXAI, la branche IA de SpaceX autrefois connue sous le nom xAI, en SpaceXSI. Il reprend ainsi le vocabulaire promu par …
Decathlon enrichit son catalogue avec le Rockrider E-EXPL 500, un VTT électrique semi-rigide affiché à 1 998,99 euros. Il embarque un moteur central Yamaha PW-C2 délivrant 55 Nm. S…
Sur le subreddit Claude, un développeur raconte la dixième semaine de son carnet de bord consacré à un jeu de pêche construit avec l'aide de l'IA. La démo est désormais téléchargea…
NousResearch a publié une nouvelle build canari de son agent Hermes, estampillée v0.21.4+canary.20261005T071900Z et datée du 5 octobre 2026. La publication apparaît sur le dépôt Gi…
Le dimanche 4 octobre 2026, Elon Musk a promis de renommer SpaceXAI, la branche d'intelligence artificielle de SpaceX, en SpaceXSI, pour « super intelligence ». Le même jour, Donal…
Elon Musk assume un régime sévère pour les cerveaux de ses robots : la puce AI5 embarque moitié moins de mémoire vive, l'AI6 un tiers de moins. « C'était la seule façon », justifie…
DJI, la marque surtout connue pour ses drones, commercialise avec le Romo A un aspirateur robot laveur. Le fabricant met en avant de belles promesses sur la navigation. Sur Amazon,…
À partir du vendredi 9 octobre 2026, les comptes Gemini sans abonnement n'auront plus accès qu'à Flash-Lite, le modèle le plus léger de Google. Les abonnés AI Plus, à 4,99 euros pa…
Les autorités américaines ont arrêté le patron d'une société informatique californienne. Il est soupçonné d'avoir expédié vers la Chine des centaines de serveurs équipés de GPU Nvi…
Le journaliste américain David Pogue a fait passer 125 commandes à Siri AI, le nouvel assistant d'Apple : dix ont échoué, selon son test publié le 17 septembre. L'assistant reste p…
D'après un article d'Axios relayé sur r/LocalLLaMA, Reflection AI serait sur le point de publier un modèle à poids ouverts américain, présenté comme une réponse à DeepSeek et Qwen.…
Officialisé en juin 2026, Siri AI est annoncé comme indisponible en Europe, et donc en France. D'après Bloomberg, l'assistant personnel de nouvelle génération pourrait le rester un…
En reproduisant une voix et en usurpant l'identité de dirigeants, des fraudeurs ont convaincu une grande banque italienne d'effectuer plusieurs virements à l'étranger. La facture s…
Un bras géant qui empile les briques d'une maison en deux jours : ces images tournent en boucle depuis des années. Les comptes du fabricant du Hadrian X racontent pourtant une hist…
Maddyness publie un article consacré aux propositions des candidats à l'élection présidentielle de 2027 en matière d'intelligence artificielle. Le média y examine ce que les préten…
La présidentielle de 2027 s'invite dans le débat sur l'intelligence artificielle. Dans un article publié le 5 octobre 2026, Maddyness passe en revue ce que les candidats proposent …
Loft Orbital, Marlan Space et Mistral AI lancent un programme d'un milliard de dollars pour déployer une constellation de 50 satellites capables d'analyser leurs données directemen…
Fondée en janvier 2026 par Yanis Grigy et Augustin Ponsin, la start-up française Fleuret AI annonce une levée de 4 millions d'euros en pré-seed. Le tour est mené par Raise Ventures…
Infermeld est un kit compagnon open-source sous Linux permettant de faire tourner un même GGUF sur un GPU AMD et un GPU NVIDIA, avec llama.cpp comme moteur d'inférence. Son mainten…
Un utilisateur de r/LocalLLaMA rapporte avoir testé le projet Strata sur une RTX 5070 Ti, avec un gain de performance de 2 à 3x sur un modèle strata-swift-iq3_xxs qu'il juge « plus…
Un utilisateur de r/LocalLLaMA fait tourner Qwen3.8-Flash-Next sur un Mac Studio. Pendant une recherche produit sur Amazon, le modèle a émis un appel d'outil vers une URL signée d'…
Sur r/LocalLLaMA, un utilisateur partage son retour sur explainroo, qui produit des vidéos explicatives narrées entièrement en local : Kokoro pour la voix, Whisper pour le calage d…
Un membre de r/LocalLLaMA veut passer d'une à deux cartes R9700 pour gagner en vitesse et faire tourner Qwen3.8-Flash-Next en Q4 ou dans des quantifications supérieures du modèle 3…
Le dépôt OpenClaw a publié le 4 octobre 2026 un correctif référencé #165143. Il garantit que les arguments de lineage restent non vides lors de la publication d'une release. La mod…
Un utilisateur de deux DGX Spark partage ses mesures : après des mois sur DeepSeek v4.0 flash (65 tokens/s en décodage, 4 à 5 agents en parallèle), il est passé à GLM 5.3 flash, un…
Un utilisateur de r/LocalLLaMA a comparé trois quantifications de GLM-4.7 sur un mini-PC Acemagic S3A (Ryzen 7 6800H, 64 Go de DDR5), via le binaire Vulkan de llama.cpp sous Ubuntu…
Un utilisateur de r/LocalLLaMA fait tourner un modèle Qwen 3.8 Flash Next GSQ RCO IQ1_M de 27,58 Go sur deux RTX 5060 Ti 16 Go et 32 Go de DDR4. Il détaille ses paramètres llama.cp…
Google a gelé son programme de bug bounty dédié à l'open source. Motif invoqué : une hausse significative des soumissions produites par l'IA. D'après TechCrunch, ce « AI slop » sem…
OpenClaw a publié une nouvelle entrée de version sous l'identifiant release-publish/6cc10ab3e851-1791145446. L'extrait associé mentionne un test côté interface (ui) portant sur un …
Dans l'émission Equity de TechCrunch, la rédaction revient sur les tentatives de l'administration Trump de retravailler l'image de l'IA. La question posée est simple : la « super i…
Un développeur a monté ce week-end une petite simulation de parkour entièrement locale, propulsée par GLM 5.3 Flash sur deux DGX Spark. Sa recette vLLM en tensor parallel 2 atteint…
Un membre de r/LocalLLaMA compile une liste de GPU GeForce GTX à petit budget, avec au moins 8 Go de VRAM et 256 Go/s de bande passante, dont les GTX 1070, 1080 et Titan X (Maxwell…
Le PDG de Micron affirme que l'offre de mémoire sera nettement plus tendue en 2027 et en 2028 qu'en 2026. La déclaration a été relayée sur le forum r/LocalLLaMA. Elle ne s'accompag…
Un développeur de r/LocalLLaMA travaille sur un tableau de bord d'inférence LLM : journaux détaillés, métriques, plafonné à 64 Mo, tout en local. Un collecteur lui permet de s'éten…
Sur r/LocalLLaMA, un développeur mène le post-entraînement d'AliceAI-80B-A3B-Base en un finetune instruct capable de conversation et de travail agentique. Il distille Qwen 3.8 27B …
L'utilisateur /u/3VITAERC publie sur le subreddit r/LocalLLaMA une comparaison de modèles de décision, intitulée « Clef Q8 vs Jev ». Le message, mis en ligne le 4 octobre 2026, ne …
Un fork de llama.cpp, AgrillaMoE, fait tourner Qwen3.6-35B-A3B avec les quants Unsloth sur un V100 16 Go, à 57-60 tok/s, en exposant les API OpenAI et Anthropic : Claude Code s'y c…
Un développeur publie repOx, un outil en ligne de commande écrit en Rust qui transforme un dépôt de code en prompt prêt à coller. Il écarte par défaut les lockfiles et les binaires…
Un contributeur de ds4 (DwarfStar) a supprimé du code plutôt que de l'encadrer de ifdef : ds4.c passe de 85 000 à 45 000 lignes, réduit à Qwen3.8 Flash Next sur Metal. Sur un M5 Ma…
Vous cherchez un ordinateur de bureau compact, efficace et pas trop cher ? Le mini PC, petit et livré clé en main, est présenté comme la solution adaptée à ce besoin. Frandroid pub…
Un développeur de r/LocalLLaMA fait tourner un Qwen3.5 9B en INT4 sur un FPGA SQRL FK33 payé 280 $ sur eBay, une carte minière dotée de 8 Go de HBM2 et d'environ 400 Go/s de bande …
Dale Caldwell, lieutenant-gouverneur du New Jersey, a été contraint à la démission le 25 septembre après une enquête concluant à du harcèlement sexuel envers un membre de son perso…
Le lieutenant-gouverneur du New Jersey, Dale Caldwell, a été contraint à la démission le 25 septembre après une enquête concluant à du harcèlement sexuel sur un membre de son équip…
Un développeur publie Apex-2, un MoE de 3,87 milliards de paramètres (1,45 milliard actif par token) entraîné de zéro, sans poids externes. Toutes les couches sont MoE (16 experts,…
Sur r/LocalLLaMA, un utilisateur fait le point sur les modèles locaux qu'il fait tourner sur une RTX 5090 : Qwen 3.8 et Qwen Flash. Il les juge très en retrait face à Opus 5.5 dès …
StarSkirmish fait s'affronter des bots de StarCraft conçus par des IA, entre eux et face à des bots humains. GPT-6 Astra (OpenAI) et Claude Opus 5.5 étaient au coude-à-coude en têt…
Selon TechCrunch, Trump a dévoilé une nouvelle task force baptisée Super Intelligence Force. Ce dispositif est présenté comme sa dernière réponse au débat en cours sur la sécurité …
Retrouver une œuvre d'art spoliée pendant la Seconde Guerre mondiale relève souvent de l'enquête au long cours. Les archives sont dispersées un peu partout dans le monde, ce qui co…
Le Journal du Geek publie son test du MOVA V70 Ultra Complete, un nouveau robot aspirateur qui débarque alors que le précédent flagship vient à peine d'être installé dans les salon…
Un utilisateur de r/LocalLLaMA raconte son escalade matérielle : d'une RTX 3090 pour LLaMA 33B à seize 3090 sur des nœuds P620, puis un Threadripper et 512 Go de DDR4 pour DeepSeek…
Sur r/LocalLLaMA, un utilisateur demande comment améliorer l'écriture créative des modèles qu'il fait tourner en local, en ciblant spécifiquement Qwen. Il juge ces modèles bien mei…
Google a saisi le Tribunal de l'Union européenne pour contester les exigences de Bruxelles. Bruxelles veut forcer le groupe à ouvrir davantage Android aux assistants IA concurrents…
Des comptes d'IA volés sont revendus à prix cassés, et des serveurs cloud sont détournés sans que leurs propriétaires s'en aperçoivent. Un analyste de Google a alerté fin septembre…
Un utilisateur de r/LocalLLaMA combine Breeze, une synthèse vocale locale, avec de la reconnaissance vocale pour dialoguer avec Opus 5.5. Sans réflexion, le premier son sort après …
Sur r/LocalLLaMA, un utilisateur demande ce qui distingue JEV d'un simple modèle d'embeddings, affirmant ne voir aucune différence. Il met à disposition son serveur JEV, qui tourne…
Le récap hebdomadaire de Frandroid revient sur le rôle de Meta dans l'affaire Bardella : des conversations Messenger datant de 2013 sont devenues un matériau d'enquête. Le site pub…
Sur r/LocalLLaMA, un utilisateur a interrogé un modèle quantifié en IQ3_S pour mesurer son débit en tokens par seconde sur une génération assez longue. La question portait sur les …
L'iRobot Roomba Plus 416 Combo Robot + AutoWash Dock est un aspirateur-laveur de milieu de gamme, conçu pour viser l'autonomie plutôt que la course aux fonctions : il aspire, lave …
Hermes Agent, dont le dépôt GitHub est hébergé par NousResearch, publie une version canari estampillée v0.21.4+canary.20261004T084456Z, datée du 4 octobre 2026. Ce canal de publica…
Un utilisateur de r/LocalLLaMA raconte avoir monté son propre serveur d'IA, puis l'avoir éteint pour le descendre au sous-sol et le remettre dans sa baie de rack. Au redémarrage, i…
Bilibili publie Index-Translate, une famille de modèles de traduction multilingue bâtie sur Qwen3.5. Les modèles texte couvrent 150 langues et suivent des consignes de terminologie…
Le Xiaomi Redmi Note 17 Pro Max 5G embarque un écran AMOLED de 6,83 pouces, avec un pic de luminosité de 3 500 nits annoncé par Xiaomi, de quoi rester lisible en plein soleil. Pour…
Roborock lance en France le Saros 20 Flow Complete, un robot aspirateur laveur qui lave le sol avec un rouleau rincé en continu à l'eau propre. La promesse : tout nettoyer en un se…
Mallow est une enceinte dopée à l'IA qui veut ringardiser les boîtes à histoires, d'après le Journal du Geek. Le média la range parmi les jouets dopés à l'IA préparés pour Noël, av…
Sur r/LocalLLaMA, un utilisateur demande si quelqu'un a déjà eu l'occasion de tester pi gui, un outil dont le dépôt est hébergé sur GitHub. Il explique ne pas savoir s'il est légit…
Un post publié sur r/LocalLLaMA relaie un extrait du prompt système de Muse, l'agent de Meta présenté comme numéro un de l'App Store. Selon cet extrait, le prompt affirme que l'aut…
Sur r/LocalLLaMA, un internaute estime qu'Anthropic, après la réponse de la Maison-Blanche sur l'interdiction des modèles à poids ouverts, déplace son argumentation sur un terrain …
Le téléviseur LG OLED65B6 passe de 1 999 à 1 599 euros, soit 400 euros de moins. Ce modèle d'entrée de gamme de la cuvée premium 2026 de LG est un grand écran OLED 4K de 65 pouces,…
Un utilisateur de r/LocalLLaMA détaille sa config : R9700, RTX 5060 Ti et 64 Go de DDR5. Il fait tourner Qwen3.8-27B en Q6 sur la R9700 à environ 35 t/s, tout en lançant ComfyUI su…
Un utilisateur de r/LocalLLaMA envisage d’échanger son Mac mini M4 Pro 48 Go contre un Mac Studio M1 Max 64 Go, sans a priori de supplément. Le vendeur ne lui a pas encore précisé …
Un développeur publie un moteur d'inférence pour Gemma-2B écrit entièrement en assembleur x86-64 à plat (FASM). Le binaire pèse 5,2 Ko, sans runtime C/C++ ni PyTorch, et s'exécute …
Sur r/LocalLLaMA, un utilisateur cherche quel modèle à poids ouverts récent est le moins flagorneur. Il juge Kimi K2 et GPT OSS 120b dépassés. Son besoin est double : un assistant …
Sur r/LocalLLaMA, un utilisateur se demande si le travail d'optimisation consacré à Qwen3.8 Flash Next servira quand Qwen4 sortira. Il s'appuie sur la page de publication du modèle…
Le dépôt Hugging Face d'Aleph-Alpha référence Kolibri-1, un nouveau modèle européen développé en Allemagne. Il s'agit d'un MoE dont la nomenclature annonce 78B de paramètres au tot…
Un utilisateur de r/LocalLLaMA fait tourner Qwen 3.8 Flash Next en quantification Q4_K_XL avec Strata, sur deux RTX 3090 et 96 Go de DDR5. Il annonce 80 à 110 tokens par seconde po…
Simon Willison estime que les services facturés à l'usage et les API doivent proposer des plafonds budgétaires durs par défaut : passé un montant mensuel, le service s'arrête et re…
Un agent qui annonce avoir terminé, une base de données qui dit le contraire : c'est le décalage que pointe ce billet du blog de Hugging Face. Ce que raconte un agent sur son propr…
Claude Code passe en v2.1.289, une livraison corrective. Les règles deny et ask ne tenaient pas sur une partie imbriquée d'une commande shell composée, et les règles de refus de Re…
Un utilisateur de r/LocalLLaMA demande comment déployer la recherche web sans risque dans Hermes, Pi et d'autres harnais d'agents, et cherche un guide de configuration pour les mod…
Simon Willison a envoyé l'édition de septembre de sa lettre d'information mensuelle, accessible uniquement aux personnes qui le soutiennent financièrement. Au sommaire : des modèle…
Un utilisateur de r/LocalLLaMA partage des benchmarks llama.cpp sur deux Radeon MI50, bridées à 145 W chacune. Chaque carte embarque 16 Go de HBM2 cadencée à 1000 MHz (1,02 To/s), …
Sur le subreddit r/LocalLLaMA, un internaute demande si d'autres ont vu passer un nouveau modèle entraîné exclusivement sur des blagues. La publication, signée u/simonbreak, est ac…
Sur r/LocalLLaMA, un utilisateur recommande Arex-2, un finetune qu'il présente comme le meilleur qu'il ait utilisé pour le codage agentique. Il ne donne ni benchmark ni évaluation …
Un développeur publie Ninfer 4080, qui fait tourner ISTA-DASLab-Qwen-3.8-27B-GSQ sur une RTX 4080 de 16 Go avec 100k de contexte. Il annonce jusqu'à 2720 tok/s en préfill et 262 to…