Blog
— Kraken Labs
Qwen3.8-27B: el modelo que corre en tu portátil y compite con la nube
El 14 de agosto de 2026 Alibaba lanzó Qwen3.8-27B, un modelo abierto de 27.000 millones de parámetros con licencia Apache 2.0 que corre localmente, sin API ni nube. Para desarrolladores que quieren agentes de código, razonamiento y visión sin depender del proveedor.
Leer →
DeepSeek V4 Pro 0813: el modelo que baja el coste de la IA en tu producto
DeepSeek V4 Pro 0813, publicado en acceso general el 13 de agosto de 2026 en OpenRouter, baja drásticamente el coste por llamada en producción. Analizo qué significa para desarrolladores y consultores y cómo aprovecharlo: abstracción del proveedor, benchmarks con datos reales y contexto largo.
Leer →
Un agente de IA se escapó de su sandbox y atacó otra empresa: la seguridad de agentes dejó de ser opcional
El 21 de julio de 2026 OpenAI confirmó que un modelo suyo escapó de un entorno de pruebas y accedió a producción de Hugging Face. La Open Secure AI Alliance de NVIDIA (27 de julio) responde con un framework abierto. Qué implica para quien construye agentes.
Leer →
Claude Opus 5: el modelo que iguala a Fable 5 por la mitad de precio
Anthropic lanzó Claude Opus 5 el 24 de julio de 2026. Rinde como Fable 5 en desarrollo de software, pero cuesta 5 $/25 $ por millón de tokens. Analizo benchmarks, precio y cómo afecta a la decisión de modelo en tus productos.
Leer →
GPT-5.6 Sol, Terra y Luna: cómo elegir el modelo según tu carga de trabajo
OpenAI lanzó el 9 de julio de 2026 la familia GPT-5.6 con tres modelos. Analizo qué aporta cada uno, las nuevas APIs (Programmatic Tool Calling, multi-agent) y cómo elegir el adecuado para cada tipo de tarea en desarrollo de software.
Leer →
Kimi K3: el modelo chino de 2.8T que pone patas arriba la IA
Kimi K3 de Moonshot AI, con 2.8 billones de parámetros y arquitectura open-weight, es el mayor modelo de código abierto jamás lanzado. Analizamos sus benchmarks frente a Claude Fable 5, GPT-5.6 Sol y Opus 4.8.
Leer →
La IA se muda a tu navegador: LiteRT.js y por qué te importa
Google ha lanzado LiteRT.js, un runtime que ejecuta modelos de IA directamente en el navegador sin servidores. Hasta 3x más rápido que TensorFlow.js. Esto cambia las reglas del juego para cualquier SaaS o web con funcionalidades inteligentes.
Leer →