Una IA dice haber probado una conjetura matemática abierta hace 50 años

OpenAI afirma que su modelo, orquestando 64 subagentes, resolvió en menos de una hora un problema abierto desde los años setenta; la pregunta es quién tendrá acceso a esa capacidad.

  • trabajo
  • educación
  • latam
  • gobernanza
▶ Escuchar la entrada
Velocidad

Lo nuevo de hoy es una afirmación grande: OpenAI publicó un paper sosteniendo que su modelo GPT-5.6 Sol Ultra, coordinando 64 subagentes en paralelo, produjo en menos de una hora una demostración de la Conjetura Cycle Double Cover, un problema de teoría de grafos abierto desde los años setenta (documento de OpenAI). Esto se suma a la historia que veníamos siguiendo esta semana sobre agentes de código convertidos en colaboradores de investigación: el mismo día, el matemático Terence Tao publicó un nuevo visualizador construido con el mismo flujo de trabajo de agentes que había documentado dos días antes, señal de que no fue un caso aislado.

Conviene leer la afirmación con calma. El matemático Thomas Bloom, de la Universidad de Manchester, calificó la prueba de “muy bonita”, pero advirtió que omite citas a trabajo previo de 1983 y que todavía no existe una revisión por pares completa. Es decir: hay un resultado que impresiona a especialistas y, al mismo tiempo, las señales habituales de que la validación matemática recién empieza. La distinción importa porque marca la diferencia entre “una IA resolvió un problema abierto” y “una IA propuso una demostración que la comunidad aún debe verificar”.

Para la región, el ángulo no es tanto el problema de grafos como el acceso. Si un modelo puede orquestar decenas de subagentes para atacar en una hora una conjetura que resistió medio siglo, la pregunta es si esa capacidad —cada vez más disponible por suscripción— puede nivelar el terreno para investigadores de universidades latinoamericanas sin supercómputo propio, o si el “descubrimiento” queda igualmente capturado por quien controla el modelo. La misma semana en que Anthropic empieza a localizar el precio de Claude para India, su mayor mercado después de Estados Unidos, esa pregunta sobre precio y acceso deja de ser abstracta.

También hoy

En la región

La semana trajo dos movimientos regulatorios concretos. México confirmó que su Congreso debatirá desde el 19 de julio un marco legal de IA, ahora con la incertidumbre sobre el T-MEC empujando hacia un enfoque más doméstico que armonizado con Estados Unidos y Canadá. Y Ecuador presentó el primer proyecto de la región enfocado específicamente en el uso de IA dentro del sistema judicial, con sanciones disciplinarias para quien emplee contenido generado por IA sin verificarlo. En Chile, el Senado sigue analizando su proyecto de regulación por niveles de riesgo sin novedades de fondo esta semana. A esto se suma un precedente llamativo: el regulador bancario de Canadá se convirtió en el primer supervisor financiero nacional en citar por nombre a un modelo de IA en una guía de riesgo cibernético dirigida a los bancos, algo que superintendencias de la región podrían empezar a replicar.

Lanzamientos

  • Perplexity Computer, actualización — suma memoria, cambio de modelo en vivo, publicación de sitios web propios y datos financieros de empresas privadas, y reincorpora a Claude Fable 5 como orquestador para tareas largas. Disponible para usuarios Pro y Max.

Hilos que seguimos

Esta es la tercera vez esta semana que la idea de “agentes de IA como colaboradores de investigación” aparece en las noticias. Empezó con Terence Tao mostrando cómo un agente de código modernizaba en horas software matemático abandonado durante casi tres décadas; siguió con un segundo experimento suyo que confirmó que el método se repite; y hoy escala a una afirmación mucho más ambiciosa por parte de OpenAI. El patrón es claro, aunque su verificación —caso por caso— apenas comienza. Vale la pena seguirlo sin comprar todavía la versión más optimista ni descartarla de plano.


Si la capacidad de orquestar decenas de agentes para atacar problemas difíciles se vuelve un producto de suscripción, ¿el próximo gran avance vendrá de quien tenga la mejor pregunta, o de quien pueda pagar el mejor modelo?

Sobre esta entrada. Se genera de forma automática a partir de fuentes públicas, sin revisión humana antes de publicarse. Puede contener errores de interpretación o de resumen; conviene verificar cada noticia en su fuente original (los enlaces llevan ahí) antes de citarla o tomar decisiones a partir de ella.

¿Viste un error? Repórtalo

Cuéntanos qué está mal —citando la frase si puedes— y, si la tienes, la fuente que lo corrige. Un proceso automático revisa los reportes cada noche: si el error se verifica, la página se corrige y queda una fe de erratas al pie.

Tu correo es opcional: solo lo usamos si necesitamos más contexto sobre el reporte. No te suscribe al newsletter.