Votre veille IA, livrée chaque matin.

Modèles, open-source, infrastructure, agents — un scan quotidien chirurgical pour les développeurs. Pas de bruit, uniquement du signal vérifié.

Sources scannées quotidiennement

arXiv

Recherche académique brute en Computer Science et Language Modeling.

Hugging Face Daily

Les papiers et modèles commentés et évalués par la communauté IA.

GitHub Trending

Détection immédiate des dépôts techniques et démos en forte croissance.

Hacker News (HN)

Signaux d'engagement de la tech mondiale avec filtrage par pertinence.

Ainsi que les flux officiels de OpenAI, DeepMind, Google AI, et les publications de IEEE Spectrum Robotique et The Robot Report.

Aperçu du dernier numéro

Mis à jour quotidiennement

Voir la page dédiée →

Gemini 3.7 Flash sort, supporté par le plugin llm-gemini 0.33

Publié le 14 août 2026

TL;DR

  • Gemini 3.7 Flash sort, supporté par le plugin llm-gemini 0.33 [1][9]
  • DeepSeek V4 Pro 0813 disponible via API sur OpenRouter, 1019 points HN [4][12]
  • Grok Bot entre en bêta, agents IA sur machine distante à 300 $/mois [3]

Les 3 signaux

⚡ Gemini 3.7 Flash — sortie et intégration outillage

Gemini 3.7 Flash — sortie et intégration outillage Google publie Gemini 3.7 Flash [1]. Le plugin llm-gemini 0.33 ajoute le support de ce modèle, ainsi que gemini-3.6-flash, gemini-3.5-flash-lite, et deux modèles d’embedding (gemini-embedding-2 et gemini-embedding-001) [9]. Sheets canvas transforme des données de tableur en dashboards interactifs via prompt simple [10].

Pourquoi ça compte : mise à jour immédiate du plugin LLM pour utiliser le nouveau modèle sans migration manuelle [9].

🚀 DeepSeek V4 Pro 0813 — API only

DeepSeek V4 Pro 0813 — API only DeepSeek V4 Pro 0813 est disponible via OpenRouter, en API uniquement [4][12]. Pas de page d’annonce officielle chez DeepSeek ; Simon Willison n’a pas confirmé de sortie des poids ouverts, mais note que les poids sont disponibles pour les versions précédentes [12].

Pourquoi ça compte : alternative potentielle aux API propriétaires, mais l’absence d’annonce officielle complique la planification d’intégration [12].

🤖 Grok Bot en bêta — agents distants

Grok Bot en bêta — agents distants Grok Bot lance des agents IA sur une machine distante, sur Mac, iOS, Windows et Linux, via l’abonnement SuperGrok Heavy à 300 $/mois [3].

Pourquoi ça compte : nouveau modèle de déploiement d’agents sur infrastructure distante, à évaluer côté coûts et latence [3].

À retenir

  1. 300 $/mois — prix de SuperGrok Heavy pour Grok Bot, agents IA sur machine distante [3]
  2. 0.33 — version du plugin llm-gemini supportant Gemini 3.7 Flash et 2 modèles d’embedding [9]
  3. 1019 points — traction HN pour DeepSeek V4 Pro 0813, API only via OpenRouter [4]

🛠 Tuto du jour

Tuto / Outil : llm-gemini 0.33 [9] Ce qu’on installe : Plugin pour l’outil en ligne de commande llm de Simon Willison, ajoutant le support des modèles Gemini 3.7 Flash et autres. Prérequis hardware & commande : API Google AI (pas de GPU local) ; llm install llm-gemini puis llm keys set gemini [9].

💻 Matos & Infra local

Sujet Matos/Infra : Grok Bot bêta : agents IA sur machine distante, Mac, iOS, Windows, Linux via abonnement 300 $/mois [3] Constat technique : Lancement d’agents sur une machine distante, multi-OS ; coût d’accès élevé (300 $/mois) pour du compute externalisé. Recommandation dev : Évaluer le ratio coût/latence de ce service distant vs. inférence locale sur Mac M-series ou GPU pour les tâches d’agents.

Sujet Matos/Infra : ReRound : quantification post-entraînement [17] Constat technique : Méthode de quantification LLM (arrondi reconstructif) ciblant l’ambiguïté du midpoint en RTN, via diffusion model. Recommandation dev : Tester ReRound pour réduire la VRAM requise en inférence locale quantifiée.

🎯 Fine-Tuning & Quantiz

Technique / Outil : ReRound, quantification post-entraînement sans calibration [17] Apport : résout l’ambiguïté de point médian du round-to-nearest via un modèle de diffusion conditionnel entraîné pour reconstruire les poids [17] Impact pratique : améliore la précision des LLM quantifiés sans nécessiter de données de calibration [17]

Technique / Outil : Fine-tuning supervisé et RL pour agents spatiaux [5] Apport : méthodes post-entraînement pour améliorer le raisonnement spatial des VLM [5] Impact pratique : applicable aux agents incarnés et à la planification robotique [5]

🧠 RAG & Agents Locaux

Architecture / Outil : LycheeMemory V2 [16] Cas d’usage : Gestion de mémoire long terme pour agents LLM, avec consolidation sémantique par segments pour réduire les coûts d’inférence en local. Clé de voûte : Consolidation différée (non-eager) des souvenirs via segmentation sémantique, évitant l’invocation LLM après chaque interaction.

📊 Track Record

Ce qu’on disait le 2026-07-31 : Google DeepMind publie Gemini Robotics 2 et ER 2, ajoutant la compréhension vidéo et la collaboration multi-robots [1][4] Verdict aujourd’hui : partiellement tenu. La dynamique robotique/agents persiste avec Strands Agents et LeRobot [2], et le papier Spatial Memory Agent confirme l’orientation spatiale [5]. Mais aucun élément ne confirme directement les capacités vidéo multi-robots de Gemini Robotics 2. En attente de validation.


🔗 Sources (18) — vérifiées le 14/08/2026 05:00 UTC

  1. Gemini 3.7 FlashHacker News · 2026-08-13
  2. Record, train, and deploy from one place with Strands Agents, LeRobot, and Hugging Face Storage BucketsHugging Face · 2026-08-13
  3. Grok Bot débarque en bêtaKorben · 2026-08-13
  4. DeepSeek V4 Pro 0813Hacker News · 2026-08-12
  5. Spatial Memory Agent: Experience-Grounded Procedure Memory for Spatial IntelligenceHF Papers
  6. PlayWorld: Benchmarking World Models with Agent Players over Long-Horizon ObjectivesHF Papers
  7. sqlite-utils 4.2.1Simon Willison · 2026-08-13
  8. sqlite-utils 4.2Simon Willison · 2026-08-13
  9. llm-gemini 0.33Simon Willison · 2026-08-13
  10. Bring your spreadsheet data to life with Sheets canvasGoogle AI · 2026-08-13
  11. alchemy-utils 0.1a1Simon Willison · 2026-08-13
  12. DeepSeek V4 Pro 0813 (on OpenRouter)Simon Willison · 2026-08-12
  13. alchemy-utils 0.1a0Simon Willison · 2026-08-12
  14. Quoting Florian HerrengtSimon Willison · 2026-08-12
  15. DarwinX: Evolving Agent Harnesses Through Natural SelectionHF Papers
  16. LycheeMemory V2: Efficient Long-Term Memory for LLM Agents via Semantic Segment-Level ConsolidationHF Papers
  17. ReRound: Reconstructive Rounding to Resolve Midpoint Ambiguity in Calibration-Free LLM QuantizationHF Papers
  18. SkillZip: Contract-Preserving Graph Compression for Scalable Agent Skill LibrariesHF Papers

V3ille — Sources : arXiv, GitHub Trending, Hugging Face Daily Papers, OpenAI, DeepMind, Google AI, IEEE Spectrum, The Robot Report.

Recevez la sentinelle demain matin

Rejoignez les développeurs qui démarrent leur journée avec les signaux IA validés et leur analyse concrète.

Zéro spam. Désabonnement instantané en 1 clic.

Rapports précédents

60 publications au total

Consulter toutes les archives
ModèlesOpen-SourceInfrastructureAgents
· 5 min de lecture

Gemini 3.7 Flash sort, supporté par le plugin llm-gemini 0.33

Gemini 3.7 Flash sort, supporté par le plugin llm-gemini 0.33 · DeepSeek V4 Pro 0813 disponible via API sur OpenRouter, 1019 points HN · Grok Bot entre ...

Consulter le rapport #V3ILLE