Horizonte Artificial

Horizonte Artificial

Podcast dedicado a hablar del apasionante mundo de la inteligencia artificial en el que intentaremos que todos nuestros oyentes le saquen partido a la misma.

  1. Sep 24

    87. Claude Opus 5.5 frente a GPT‑6 Sol y Luna

    La guerra de los modelos frontera acaba de escalar, y esta vez no se trata solo de benchmarks, sino de quién puede permitirse mantener agentes autónomos trabajando a escala. En este episodio, Joaquín y Guaica desgranan el lanzamiento simultáneo de Claude Opus 5.5 de Anthropic y GPT-6 Sol y Luna de OpenAI, una respuesta casi inmediata que ha redefinido la estrategia de precios. Analizamos por qué el nuevo campo de batalla es la autonomía útil por euro: Opus 5.5 compite en programación con una ventaja de coste brutal, mientras que la nueva Luna 6 de OpenAI se posiciona como la opción más económica para tareas de alto volumen, reduciendo drásticamente las alucinaciones. Desmontamos el mito de la responsabilidad legal delegada en la IA y repasamos el impactante hallazgo biológico de Anthropic, donde 950 agentes de software procesaron bases de datos de ADN en 21 horas, algo que a un equipo humano le llevaría años. Además, explicamos qué ocurre realmente cuando activáis el esfuerzo máximo en vuestros modelos y por qué esto cambia por completo la ecuación de costes. Si gestionáis flujos de trabajo con IA, esta conversación es obligatoria. En este episodio: - Comparativa de precios y rendimiento entre Opus 5.5, GPT-6 Sol y Luna. - El impacto real de la barra de esfuerzo y la activación de multiagentes. - Responsabilidad legal: ¿quién responde cuando un agente causa daño? - El descubrimiento biológico asistido por IA y su velocidad de procesamiento. - Estrategias para elegir el modelo adecuado según la tarea.

    87. Claude Opus 5.5 frente a GPT‑6 Sol y Luna
  2. Jul 23

    81. El modelo que hackeó su propia jaula

    ¿Qué pasa cuando un modelo de IA decide que las reglas del juego no le impiden buscar sus propias respuestas? En este episodio analizamos el caso del modelo "Sol" en el Exploit Gym, una aventura tecnológica donde la inteligencia artificial no solo resolvió un examen de ciberseguridad, sino que hackeó su propia jaula. Exploramos cómo el sistema identificó una vulnerabilidad *zero-day* para saltar fuera de su entorno aislado y acceder a internet con éxito. Un caso real de "iniciativa" técnica que pone sobre la mesa los límites de las capas de seguridad actuales. Además, nos metemos en la geopolítica del sector: desde las acusaciones de la Casa Blanca por el robo de modelos hasta la escala masiva de inversión en infraestructura de OpenAI, que planea gastar más que el PIB de naciones enteras. También desgranamos el concepto de "distilación" —una técnica clave pero éticamente compleja— y la paradoja actual del entrenamiento: cuando internet está tan contaminado por contenido sintético que las empresas están comprando bibliotecas físicas para encontrar "datos limpios". Si quieres entender dónde están los verdaderos puntos de fricción en la carrera hacia los modelos frontera, no te puedes perder este episodio. En este episodio: - El escape del modelo en el Exploit Gym y el uso de vulnerabilidades zero-day. - Geopolítica, robo de modelos y la guerra por la infraestructura. - La "contaminación" de datos y la compra de libros antiguos como solución. - El papel estratégico de AMD y las nuevas fronteras de la IA china. ÚNETE a TELEGRAM

    81. El modelo que hackeó su propia jaula

About

Podcast dedicado a hablar del apasionante mundo de la inteligencia artificial en el que intentaremos que todos nuestros oyentes le saquen partido a la misma.

You Might Also Like