
Hosted by Nova y Alloy · ES

GPT-5.6 Sol busca resultados de agentes más completos, ChatGPT consolida trabajo y codificación, y Gemini 3.5 Flash opera pantallas y crea software. También examinamos Bonsai 27B, IA Pixel sin conexión, desktops AMD de 128GB, soporte de backend de JetBrains Copilot, acceso a modelos basados en riesgo de Anthropic, resultados de pequeñas empresas, límite de robótica de Claude, acción gubernamental en Nueva York, Australia y GOLD EAGLE, además de la reconstrucción con IA de Google del gol perdido de Pelé en 1959. Show notes: https://tobyonfitnesstech.com/es/podcasts/episode-87/

Hoy AgentStack Daily cubre tres lanzamientos de harness — OpenClaw v2026.7.1, OpenAI Codex rust-v0.144.4 y Claude Code CLI 2.1.202 — además de Kwaipilot uniéndose a OpenRouter. Las nuevas investigaciones de agentes incluyen ABot-AgentOS para control robótico, ABot-N1 de Amap para navegación visual, LightMem-Ego para memoria multimodal en wearables y JobHop v2 para razonamiento de trayectoria profesional. También examinamos un estudio de puertas traseras multi-agente, QA de video basado en evidencia de Salesforce, el benchmark de anclaje visual MM-ToolSandBox y AdvancedMathBench. Show notes: https://tobyonfitnesstech.com/es/podcasts/episode-86/

OpenAI lanza Codex rust-v0.144.3 y rust-v0.144.2; vLLM 0.25.0 establece Model Runner V2 como predeterminado para modelos densos. Apple demanda a OpenAI por presunta sustracción de secretos comerciales por exempleados. Además, Freya‑TTS incursiona en el habla turca con un DiT de 183M basado en flow‑matching, SAGEAgent reduce la carga diagnóstica del glioma en un 55%, Agora pasa de un enrutador a una subasta sobre pasos de razonamiento, un sistema de dos agentes obtiene 0.402 en QANTA 2026, PAC‑ACT entrena políticas de Action Chunking Transformer con aprendizaje por refuerzo a nivel de fragmento, y Semantic Pareto‑DQN. Show notes: https://tobyonfitnesstech.com/es/podcasts/episode-85/

Hoy, AgentStack Daily examina Codex 0.144, la línea GPT-5.6 Sol, Terra y Luna de OpenAI, y el lanzamiento de Grok 4.5 de SpaceXAI. También cubre la capacidad de escucha y habla simultánea de GPT-Live, el modelo Robostral Navigate de 8B de Mistral, ChatGPT Work, Microsoft Flint, y nuevas investigaciones sobre memoria de control continuo, evaluación de citas, evaluaciones de codificación, agentes proactivos, investigación web delegada, recuperación de código procedural y pruebas de agentes en mercados energéticos. Show notes: https://tobyonfitnesstech.com/es/podcasts/episode-84/

Hermes Agent ships v2026.7.7, OpenAI Codex lands rust-v0.143.0, and Claude Code CLI rolls out 2.1.197. AionLabs releases Aion-3.0-Mini roleplay model on OpenRouter. Kokoro delivers high-fidelity TTS on low-power CPUs. Rowboat hits 162 points on Show HN as a local-first Claude Desktop rival. GitHub AI agent prompt injection leaks private repo contents. Early-failure probes cut wasted compute in agent loops. Plus Danus, FreqDepthKV, DepthWeave-KV, RuBench 1.0, VAORA, and Anthropic developer-relations friction around API migration.

Claude Code CLI 2.1.195 se lanza junto con Tencent Hy3 y Nex-AGI Nex-N2-Mini en OpenRouter, mientras GLM 5.2 reaviva el debate sobre el colapso de márgenes en IA. Anthropic publica un análisis de interpretabilidad de la Teoría del Espacio de Trabajo Global, y una filtración de sesión de Claude Code junto con una publicación que erosiona la confianza se vuelven trending en Hacker News. Además, Ternlight libera un modelo de embedding WASM de 7 MB para el navegador, y se presentan investigaciones sobre Graph Sparse Sampling, destilación on-policy weak-to-strong, el paper VLM-VLA bidireccional de Cortex, entrenamiento multi-agente Graph-as-Policy y un estudio sobre estilo y agentes de código. Show notes: https://tobyonfitnesstech.com/es/podcasts/episode-82/

Hoy, AgentStack Daily informa sobre GPT-5.6 Sol Ultra camino a Codex junto con una actualización de espacio de trabajo de código listada en GitHub, además del banco de trabajo de IA OpenScience de Synthetic Sciences para la investigación científica. Independent Build lanza un modelo de lenguaje de 270 M parámetros con pesos abiertos, el lanzamiento escalonado de Qwen reaviva las dudas sobre la viabilidad de modelos locales, y un agente web local que funciona exclusivamente con Ollama llegó a la portada de r/ollama. Las selecciones de investigación incluyen ataques entre PR en agentes de codificación, canales de debate extraoficiales en sistemas multiagente y rúbricas autoevolutivas. Show notes: https://tobyonfitnesstech.com/es/podcasts/episode-81/

AgentStack Daily hoy cubre la regresión de tokens de razonamiento de GPT-5.5 Codex, el problema de contaminación cruzada de sesión y caché de Claude Code en hosts compartidos y el lanzamiento de Mistral 1.5. También destaca el soporte nativo de la arquitectura Kimi K2.5 a K2.7 en Transformers 5.13, el método de la USAF para ajuste fino de MoE en GPUs de 12 GB, la revocación por Cheyenne de los permisos de descarga de agua del centro de datos de Meta tras hallazgos de contaminación, y el lanzamiento de código abierto de un adaptador de ASR por difusión de Interfaze para DiffusionGemma. Show notes: https://tobyonfitnesstech.com/es/podcasts/episode-80/

El Resumen de Lanzamientos del Agent Stack de esta semana lidera con Hermes Agent v2026.7.1 enviando junto a Claude Code CLI 2.1.193, con Kimi K2.7 Code alcanzando GA dentro de GitHub Copilot. ZCode envuelve GLM-5.2 y llega a la portada de Hacker News, Leanstral 1.5 trae generación de pruebas Lean con pesos abiertos, y Alibaba bloquea Claude Code en el trabajo por preocupaciones de puerta trasera. La guía de GitHub de Jamesobcura LLMs SOTA ejecutables localmente, WebBrain envía un agente de navegador local-primero para Chrome y Firefox, ReContext publica. Show notes: https://tobyonfitnesstech.com/es/podcasts/episode-79/

Agent Stack Daily cubre el regreso de Claude Fable 5: las restricciones de EE.UU. sobre los modelos Mythos y Fable de Anthropic fueron levantadas el 30 de junio, y el flagship clase Mythos está de vuelta en OpenRouter con contexto de 1M, entrada multimodal y soporte de razonamiento. Se lansaron OpenClaw v2026.6.11 y OpenAI Codex rust-v0.142.5, y Claude Sonnet 5 llegó a OpenRouter con contexto de 1M junto con el Nano Banana 2 Lite de Google. La investigación incluye el paper de espacio latente mundial unificado de Orca, el MoE de 35B Agents-A1, y BlockPilot sobre decodificación especulativa de difusión. Show notes: https://tobyonfitnesstech.com/es/podcasts/episode-78/