🚀 Modelos & Releases
vLLM v0.25.0 ya está disponible. Esta versión establece Model Runner V2 como el camino de ejecución predeterminado para todos los modelos densos, con nuevo soporte para EVS y embeddings en tiempo real. (https://github.com/vllm-project/vllm/releases/tag/v0.25.0)
🛠️ Herramientas & Productos
Llama.cpp lanzó un commit que corrige un problema en Vulkan para GPUs Adreno, donde llama-cli fallaba con prompts largos en redes cuantizadas q4_0 debido a memoria compartida insuficiente. (https://github.com/ggml-org/llama.cpp/releases/tag/b9969)
Browser-use publicó la versión 0.13.4, que incluye un servidor MCP para CLI 3.0 y correcciones en la detección de navegación y extracción de markdown. (https://github.com/browser-use/browser-use/releases/tag/0.13.4)
Crush lanzó la versión 0.84.1, que finalmente implementa afinidad de sesión enviando correctamente los headers de ID de sesión. (https://github.com/charmbracelet/crush/releases/tag/v0.84.1)
🔬 Investigación
Se presentó Long-Horizon-Terminal-Bench, un benchmark que evalúa a los agentes de IA en tareas de terminal de largo horizonte, incorporando una calificación basada en recompensas densas para medir el progreso intermedio. (https://huggingface.co/papers/2607.08964) Jet-Long es un nuevo método para extender el contexto de LLMs de manera eficiente utilizando RoPE Bifocal Dinámico, útil para aplicaciones que exceden la ventana de preentrenamiento. (https://huggingface.co/papers/2607.07740) OpenCoF propone un nuevo enfoque para el razonamiento a través de la generación de video, utilizando secuencias de frames conectados temporalmente como alternativa al Chain-of-Thought. (https://huggingface.co/papers/2607.08763)
🏢 Industria & Negocios
OpenAI está apostando por las familias, contratando a un gerente de producto dedicado para construir experiencias de ChatGPT para familias, cuidadores y adultos mayores. (https://techcrunch.com/2026/07/11/openai-bets-on-families-as-chatgpt-goes-deeper-into-households/)
⚖️ Regulación & Sociedad
Más de 200 manifestantes marcharon hasta las oficinas de OpenAI y Google DeepMind exigiendo una regulación de la IA y una pausa en la carrera de desarrollo. (https://news.google.com/rss/articles/CBMihgJBVV95cUxPTktKSE9ISGp0V1N2cVBFZjU4V2dfSDdUazM5RVhfR2szN0IyN2ZPc0xKRmpRQmtBVDhzWFg0TFBFU2EtOFlQbjBsVnJwQUt0RlZVYUNkOWdoYVh6MWRBdG9FQ2E1WE85T3BUOTBpTmxRQnF5XzRTdS00ekl3MHBxODY2ZXllMEg5Q240RkNyYXF6bFVTOXkwLUc0VVZ0ZnBqZW5TbFFFM085YTV5b0VBT21BUDRQVnZtdVJRT19aODFyY2lFU1JTUUFnRHhZU2NjWHpRV3pBWVFVNzZzMmF5YlhKMGNMdWtOUjJWZGZYei1EQnZPYmJRckxEWXdHZUVEcEFlNklR0gGLAkFVX3lxTE8wc1owT3daR1FPWmxjVVRsX3M4WmExZDFGa0p1ZUNudlh0U21GXzdkLURhRG9FNkJIRXlJVVAzcEp5bWYwTFlWZDRwSkt5aXRnUlhqeUlsSG9xajFQOFhKUXZyOGpJb1ZrYTdKUkM5RzZpOTBlU0FwVVlHOWlVLThjQjdxbElmOVktbDNrU0dDN0FZQkNKeXFGUGc0YWxvZDBuMzVabEd6Vk8yRHJXNE5OMVIwSEZYSjQyTTc4MkRFdTFrZVRISmxpVXZvM0s2aTU1Z3h0TmpvVmQwNkRzcXA2b21kbzFaVl9OcFg0ZF9IWTVsRjAxVDFsS2VlRlBLU3JNbWtqWnF6WVRORQ?oc=5) Expertos abogan por una regulación equilibrada de la IA para desbloquear la economía digital. (https://news.google.com/rss/articles/CBMixgFBVV95cUxNYTJOd21JRDVNbUhEdHJwdzBjYVQ0bDMxaTNyTjNxcEcyTkFtaXhXaUJDYUJRWktDLEtnSURJZDROalVUYVpzdUNqbkVHSnFQN29FTnRpSDhtQ2E2X3JEQnkwRUQwNUNfd1poUHpwckI0SEdMSVNJZTdTWkZTLWVCWkdEMXl0cWlqX0RhYlNNcXpRenZmTjNZTXpial9YS09ybUdsOUlOMFcwTUQ1cFlkVlp4QnZFYlppdDU1T2xVTEdERVU5dWc?oc=5) Se sugiere que para una buena política de IA hay que mirar a una facultad de derecho específica. (https://news.google.com/rss/articles/CBMirAFBVV95cUxNS2RZR1llRGpnWVh5WXE0U2h0cXIxVTUtbDF6SGt3cWZ5TWVDbGtTc1dxdWV2NlFUbFB5X0V4cEhGOWRBMzUzTGwwVHBJRE9tUlFzeFlNeFlkdzhrMGM2LTRaZXVMdkxSWjdLcmRaWEsyX29IeVFXMWhyZldjSVFmT3U5ZW1TRklBQmsyNm9SQ2VVV1hPSUMwUE9Ddm5UaVBHdlJBbTlndzIwYTRW?oc=5)
💡 A retener
La actualización de vLLM a la versión 0.25.0 establece Model Runner V2 como el camino de ejecución por defecto, un cambio importante para desarrolladores que utilizan este servidor de inferencia de alto rendimiento y que puede afectar la compatibilidad o el rendimiento de implementaciones existentes.