🚀 Modèles & Releases
Anthropic a lancé Claude Opus 4.8, son modèle le plus performant généralement disponible, avec une fenêtre de contexte de 1M tokens par défaut et 128k tokens de sortie max. (https://docs.anthropic.com/en/release-notes/api#may-28-2026) Kwaipilot a publié KAT-Coder-Air V2.5, un modèle de codage agentique de niveau flagship conçu pour gérer des workflows métier entiers de manière autonome. (https://openrouter.ai/models/kwaipilot/kat-coder-air-v2.5) Kwaipilot a également publié KAT-Coder-Pro V2.5, un autre modèle de codage agentique de niveau flagship. (https://openrouter.ai/models/kwaipilot/kat-coder-pro-v2.5)
🔬 Recherche
Une publication sur arXiv présente Trust Region Policy Distillation (TOP-D), une méthode visant à stabiliser l'On-Policy Distillation (OPD) en construisant dynamiquement un enseignant proximal. (https://huggingface.co/papers/2607.04751) Une autre publication propose d'utiliser des données non labellisées pour améliorer la généralisation du décodage de populations neuronales. (https://arxiv.org/abs/2607.14086v1) Une troisième publication introduit une nouvelle approche pour l'Analyse en Composantes Indépendantes (ICA) linéaire via le Transport Optimal. (https://arxiv.org/abs/2607.14081v1) Une quatrième publication présente MetaPerch, une méthode exploitant les métadonnées pour améliorer les modèles de fondation en bioacoustique. (https://arxiv.org/abs/2607.14072v1)
🏢 Industrie & Business
Microsoft formerait ses commerciaux à présenter ses modèles d'IA maison comme plus efficaces et rentables que ceux d'OpenAI et d'Anthropic. (https://techcrunch.com/2026/07/15/microsoft-is-reportedly-training-salespeople-to-talk-down-openai-and-anthropic/) Applied Computing a levé 20M$ en Series A pour construire un modèle d'IA de fondation pour l'industrie pétrolière, gazière et pétrochimique. (https://techcrunch.com/2026/07/15/applied-computing-wants-to-give-oil-and-gas-operators-an-ai-model-for-the-entire-plant/)
🛠️ Outils & Produits
Weaviate a publié les versions v1.36.22 et v1.38.4 de sa base de données vectorielle, apportant des correctifs de performance et de stabilité pour le nettoyage des segments LSM, la récupération WAL et la réplication asynchrone. (https://github.com/weaviate/weaviate/releases/tag/v1.36.22) (https://github.com/weaviate/weaviate/releases/tag/v1.38.4) TensorRT-LLM v1.3.0rc21 annonce la dépréciation du backend AutoDeploy, l'équipe travaillant sur des approches agentiques pour accélérer le support des modèles. (https://github.com/NVIDIA/TensorRT-LLM/releases/tag/v1.3.0rc21) Llama.cpp a ajouté une implémentation CUDA pour l'opérateur GGML_OP_LIGHTNING_INDEXER. (https://github.com/ggml-org/llama.cpp/releases/tag/b10032) Crush v0.85.0 introduit un outil de question de première classe (single/multiple choice, texte libre, etc.) pour les interactions avec les LLMs. (https://github.com/charmbracelet/crush/releases/tag/v0.85.0) Ollama v0.32.1 améliore l'appel d'outils et le raisonnement multi-tours pour Gemma 4, et corrige une fuite mémoire dans le cache des modèles MLX. (https://github.com/ollama/ollama/releases/tag/v0.32.1-rc0) AutoGPT Platform v0.6.67 ajoute un support de première classe pour les organisations/espaces de travail (schéma, auth, APIs, migration, frontend). (https://github.com/Significant-Gravitas/AutoGPT/releases/tag/autogpt-platform-beta-v0.6.67) Cline CLI v3.0.42 corrige le routage de l'API native Ollama pour que les paramètres de fenêtre de contexte et de timeout fonctionnent à nouveau. (https://github.com/cline/cline/releases/tag/cli-v3.0.42)
⚙️ API & Dépréciations
L'API Admin d'Anthropic est en bêta pour toutes les organisations Claude Enterprise, permettant de gérer les membres, les rôles, les groupes et les invitations via l'API. (https://docs.anthropic.com/en/release-notes/api#july-14-2026)
⚖️ Régulation & Société
Le Japon a révisé ses lignes directrices de politique d'IA pour renforcer la cybersécurité. (https://news.google.com/rss/articles/CBMilAFBVV95cUxNU3U5ZHNqVjJxb0EwTWk2VjJIN2xDelhySXhKTTJBMDNqU01mWWpXYkVmU1NLUmJCemNhTnpKTDBJZTNqTmtSOWIyX0tGZ1RFZWZhRmpsUFFCb1QxVG50TlNwTlBfUTV4bW81OGtHY2ZKTDQtVFZVX3I4T1o2RjY5TklCUU51UHFiZW1WemloRFV3STZ6?oc=5) Un article compare la régulation de l'IA à l'échelle mondiale. (https://news.google.com/rss/articles/CBMieEFVX3lxTE1RQ2FWUGd2bVhld29vV29tVFR3NjBPMWxPVVFmeFJTRnNYSG43VnlGd3BZdmxuOTR3NUV6eXlkZHN4SElNTk5WSkQ5WkY3aWdoWmY0UjFCWHZ0U1FQdUtDd29ITHVYXzdGSmJuM1NhVjZPeEhlNXBhag?oc=5) Un éditorial du Rep. Max Rose suggère que le Congrès américain devrait s'inspirer des succès de l'ère Internet pour réguler l'IA. (https://news.google.com/rss/articles/CBMi1wFBVV95cUxPaGswLXBONTVCVWpib2dGempQaHh4aXhLbUF2czlJRFduU3pQUWRqaFBER3VWQVBzeWhZRUZtLUt4c1E3Sk5IOVNaXzZoajQxVXRncWprR1pxOXhhbTg5b2VLWkNEUUdEUmV5YlpTRXRrRGoxWkN2d1VJRS1xQi1UODVHTXZnZ3FmY1ByRi14aWJtd1R0YjZXVVM3ZWNwWENJN3F6R1htVXE3anlrU2RPSjZfRll5S2dDazlxS0g3bWV5d1JlZmNtYzB2OHZCUnY5UlhsTHpCTQ?oc=5)
💡 À retenir
OpenAI utilise désormais GPT-Red, un LLM "super-hacker" interne, comme partenaire d'entraînement adversaire pour renforcer la sécurité de ses autres modèles, notamment GPT-5.6. (https://www.technologyreview.com/2026/07/15/1140514/meet-gpt-red-an-llm-super-hacker-openai-built-to-make-its-models-safer/)