Podcast ONE: 4 de septiembre de 2026 GPT-6 Astra, NVIDIA Pair y LM Studio Bionic: @vincent_quezada y @zoomdigitaltv analizan la nueva era de la IA local y en la nube. #one_digital #onedigital #PodcastONE #IA Escucha aquí el Podcast ONE: 4 de septiembre de 2026 One Digital: GPT-6 Astra, NVIDIA PAIR y la IA local marcan la semana Resumen: Vincent Quezada y Pablo Berruecos analizan el lanzamiento de GPT-6 Astra, la herramienta NVIDIA PAIR para IA local distribuida, LM Studio Bionic frente a Claude, el generador musical HappyShrimp de Alibaba y reseñan Metal Gear Solid Master Collection Vol. 2, Fight School Simulator y Patchkins Party. Grabado el 4 de septiembre de 2026 desde São Paulo y Ciudad de México. ¿Qué es GPT-6 Astra y por qué cambia las reglas de la IA? OpenAI presentó el 3 de septiembre de 2026 GPT-6 Astra, descrito como el modelo más inteligente y alineado de la compañía hasta la fecha, con avances en ciberseguridad, ciencia, desarrollo de software y automatización profesional. Según los benchmarks compartidos en el comunicado, Astra alcanzó 98% en Frontier Math Tier 4 v2, 99.9% en razonamiento abstracto (ARC-AGI-3), 100% en ExploitBench y 59.3% en Agents Last Exam, superando a Claude Opus 5 y GPT-5.6 Sol en múltiples categorías. Vincent Quezada compartió su primera impresión tras ver la presentación: “Es muy, muy sorprendente lo que logró OpenAI con este tipo de lanzamientos que nos dejaron así, en una cuestión de impacto”. El modelo ya está disponible para un grupo limitado de organizaciones y se extenderá en los próximos días a ChatGPT Plus, Pro, Business y Enterprise, además de la API de OpenAI y Amazon Bedrock (AWS). Costo de API: 10 dólares por millón de tokens de entrada y 50 por millón de salida. Soporta cero retención de datos (zero data retention) para clientes elegibles de la API. En pruebas de tareas imposibles, Astra nunca fingió completar una restricción evadida, contra un 48% de casos en GPT-5.6 Sol. Es tres veces menos probable que haga afirmaciones inexactas sobre sus propias capacidades. Entre los usos prácticos demostrados están el diseño de circuitos impresos (PCB) en KiCad, análisis de secuenciación genética, desarrollo de videojuegos completos en minutos y modelado 3D en Blender exportado a Unreal Engine 5. El lado crítico: el mismo ExploitBench al 100% implica que la herramienta puede identificar vulnerabilidades de software casi tan rápido como pueden explotarse, lo que obliga a las empresas a acelerar sus ciclos de parcheo. ¿Cómo funciona NVIDIA PAIR para correr IA local más rápido? NVIDIA presentó en el IFA 2026 PAIR (Personal AI Router), una herramienta gratuita y de código abierto que distribuye el cómputo inactivo de varios PCs en una red doméstica para ejecutar modelos de IA local hasta 1.9 veces más rápido. Según datos citados por NVIDIA, más del 50% de los hogares en Estados Unidos tienen dos o más PCs, y buena parte de ese poder de cómputo permanece sin usar. PAIR es compatible con Windows, macOS y Linux, y funciona sobre GPUs NVIDIA GeForce RTX serie 20 en adelante, RTX Pro (arquitectura Turing o superior), DGX Spark y equipos Apple M4 o superiores. Se integra directamente con herramientas ya conocidas por la audiencia de IA local, como Ollama y LM Studio. ¿Qué necesito para instalar NVIDIA PAIR en mi red? Instalar Pair en cada dispositivo que formará parte del clúster doméstico. Configurar el workflow a través de Ollama o LM Studio. Seleccionar el mismo modelo de IA en todos los equipos (no se puede mezclar, por ejemplo, Gemma con Llama). Asignar el rol de apoyo a GPUs modestas en vez de esperar que sostengan la carga principal. Vincent probó la herramienta en su propio home lab combinando LM Studio con el agente Hermes: “No lo pude hacer funcionar como yo esperaba con LM Studio directo, pero con Hermes sí llegó a funcionar más adecuado”. Su valoración final fue equilibrada: “PAIR es una de las innovaciones más prácticas de NVIDIA en 2026, ya que resuelve el problema real del subuso de hardware… pero no es una herramienta mágica”. Frente a alternativas de trabajo distribuido como Kubernetes o Docker Swarm, Pair destaca por su interfaz gráfica de configuración automática y su enfoque específico en IA y agentes locales, aunque a costa de requerir hardware NVIDIA o Apple compatible, mientras que las otras opciones son agnósticas de plataforma. ¿LM Studio Bionic puede reemplazar a Claude en el trabajo diario? La actualización de LM Studio Bionic convierte modelos abiertos en agentes de trabajo, combinando ejecución local, remota e híbrida. A diferencia de Claude, que concentra toda la operación en el ecosistema de Anthropic, Bionic permite decidir tarea por tarea qué se procesa en el equipo y qué se envía a la nube. Enfoque: Claude ofrece experiencia integrada en un solo ecosistema; Bionic funciona como agente híbrido: local, remoto o nube. Privacidad: en Claude depende del plan y la retención contratada; Bionic aplica procesamiento local con zero data retention por defecto. Conectores: Claude se limita a su propia familia de modelos; Bionic suma MCP, Skills, shell, archivos y sesiones de proyecto. Costos: Claude cobra por suscripción con créditos según plan; Bionic es gratis en local y cobra solo por consumo en modelos remotos. Bionic introduce los Skills como pieza central del flujo de trabajo: rutinas reutilizables que encapsulan un método o tarea repetible sin reescribir instrucciones extensas en cada conversación. Vincent lo resume así: “Van a hacer la talacha una sola vez, pero van a ver una productividad enorme a futuro porque todo lo hacen de un solo momento, queda guardado, lo reutilizan”. ¿Qué modelos locales funcionan bien en laptops de 8 a 12 GB de RAM? Bonsai (1-bit, derivado de Qwen 3.6, 27B): ideal para resúmenes, análisis estructurado y productividad diaria. Gemma 4 E4B: denso y eficiente, funciona incluso en celulares; útil para clasificación y borradores. Gemma 4 26B 4AB: cuantizado, cerca del techo de rango con contexto prudente. Qwen 3.5 35B A3B y Qwen 3.6 35B A3B: arquitectura Mixture of Experts (MoE), buena para código y uso de herramientas. Qwen 3 Coder 30B A3B Instruct: estable para codificación técnica y agentes, aunque por debajo de Claude en sesiones extensas. En costos de API, la comparación es reveladora: Claude Opus 5.1 cobra hasta 10 dólares por millón de tokens de entrada y 50 de salida, mientras que GLM 4.3 en Bionic ronda 1.40 de entrada y 4.40 de salida, y Kimi K2.7 Coder llega a 0.95 de entrada y 4 de salida. Para Vincent, la estrategia ideal es mixta: “Todo el proceso de investigación, de generación, de formateo y estructura lo pueden hacer con el agente de LM Studio Bionic, y ya el trabajo fino lo pueden subir a su cuenta de Claude”. ¿Vale la pena HappyShrimp para crear música con IA? HappyShrimp 1.0 es el generador musical de Alibaba, capaz de producir canciones completas —letra, voz, melodía y arreglo— a partir de un prompt en lenguaje natural o de una letra estructurada por secciones (Title, Verse, Chorus). Compite directamente con Suno, Udio y Mureka. Cada generación consume 20 créditos y devuelve dos versiones para comparar. Duración máxima aproximada de 5 a 6 minutos por canción. Exportación en WAV disponible en plan premium, algo que Udio no ofrece. Es multiidioma, a diferencia de Mureka, que solo trabaja en inglés. En la prueba comparativa de la conducción, usando el mismo prompt en Suno y HappyShrimp, los resultados fueron similares, aunque Vincent prefirió ligeramente la calidad de audio de HappyShrimp: “Lo que no me gustó de HappyShrimp es que si no pones el nombre de la canción, automáticamente lo hace en chino”. La herramienta sigue en fase beta, con términos de uso comercial aún por confirmar, por lo que se recomienda revisar la licencia antes de publicar cualquier pieza generada. ¿Qué juegos destacaron esta semana? La sección de reseñas cubrió tres lanzamientos con perfiles muy distintos entre sí, evidenciando la diversidad del catálogo actual. Metal Gear Solid Master Collection Vol. 2 Este recopilatorio reúne tres experiencias de la saga —una epopeya sobre guerra privada e IA, una precuela de gestión de bases móviles en la Guerra Fría y un título portátil en 2D— con libros digitales, guiones y banda sonora extendida. Corre a 60 cuadros por segundo estables y está disponible en Steam, PlayStation Store, Xbox Store y Nintendo Shop. Entre sus mejores atributos están la inteligencia artificial enemiga dinámica y los rangos de sigilo sin eliminaciones; entre sus debilidades, cierta repetición en las misiones de gestión de base. Fight School Simulator Una producción independiente que combina gestión de una escuela de artes marciales con combate en primera persona. El jugador construye instalaciones, entrena alumnos y defiende el dojo de bandas rivales, con un estilo visual funcional que recuerda a producciones de PlayStation 2. Disponible en Steam, PlayStation 5 y Xbox. Su punto débil declarado por la conducción es un sistema de combate que podría ganar profundidad técnica frente a juegos de lucha especializados. Patchkins Party Un party racing indie multijugador de hasta ocho personas donde los propios jugadores dibujan el circuito ronda tras ronda, colocando trampas y atajos. Sin campaña ni narrativa elevada, apuesta todo a la improvisación y el humor físico, con estilo visual dibujado a mano. Disponible en Steam para PC por 7.99 dólares. Panorama de eventos: Fundación Telmex, Nokia y el mapa Equal Earth Desde Ciudad de México, Pablo Berruecos reportó su asistencia al evento anual de la Fundación Telmex Telcel, con presencia de Justin Trudeau (ex primer ministro de Canadá), el compositor Andrew Lloyd Webber y el técnico de la selección nacional de fútbol, Javier A