Radar

radar · IA & agentes

We need to talk about this...

a tese

Matthew Berman noticia que a OpenAI anunciou ter resolvido o problema de Navier-Stokes (um dos Prêmios do Milênio) com agentes de IA, e usa o caso, cercado de disputa de autoria, para argumentar que estamos à beira da automelhoria recursiva e do risco de plataforma para quem constrói sobre esses modelos.

aprofundar

talvez

O tom é empolgado e a legenda embaralha OpenAI/Anthropic, mas o caso Navier-Stokes, a disputa de autoria com dados privados e a automelhoria recursiva tocam de perto seus interesses em IA e agentes; leia com o filtro de ceticismo.

O que foi dito

  • Explica Navier-Stokes como as equações que descrevem o movimento de fluidos (asas de avião, correntes oceânicas, clima, resfriamento de chips) e um problema aberto há cerca de 90 anos, com prêmio de US$ 1 milhão.
  • A OpenAI afirma que a prova foi produzida por um grupo de agentes usando um modelo de próxima geração bem superior ao “GPT Astra” (GPT-6), lançado quatro dias antes.
  • Relata a polêmica: os matemáticos Tristan Buckmaster (também funcionário da Anthropic) e Levent Alpaji (grafia incerta) trabalhavam há um ano no problema usando o Codex da OpenAI e guardavam rascunhos ali; a IA da OpenAI teria seguido a mesma abordagem incomum e concluído a versão mais difícil pouco depois de a empresa saber do avanço deles.
  • Buckmaster acusa a OpenAI de correr para publicar sem as checagens usuais, controlar o crédito e quase deixar seu nome de fora por ele ser da Anthropic; a OpenAI nega ter acessado o trabalho deles, mas admite não poder descartar que dados desidentificados do uso de seus produtos tenham ajudado a treinar os modelos.
  • Sebastien Bubeck (grafia incerta), líder da iniciativa Navier-Stokes na OpenAI, publicou prints alegando ter tentado coordenar as divulgações e nunca pedido a remoção da autoria, e que Levent se recusou a comparecer às reuniões.
  • Números da OpenAI: o problema, aberto a humanos por mais de 80 anos, teria sido resolvido em 88 horas (1 a 5 de setembro), com 4,9 milhões de mensagens entre agentes e 300 bilhões de tokens de saída.
  • Berman conecta ao tema da automelhoria recursiva (RSI): OpenAI e Anthropic já usam IA para acelerar a própria pesquisa (GPT 5.5 ajudando a construir GPT 5.6), ainda sem loop totalmente fechado; e alerta para o “risco de plataforma”, já que quem constrói negócio sobre esses modelos entrega dados que podem treinar futuros concorrentes, defendendo modelos de código aberto.

Mais de Matthew Berman

42 no radar
10/10Everything has been solvedaprofundar: não07/10Mistral is BACK! (Le Chonk)aprofundar: talvez07/1012 Grok Bot Use Cases That Feel Illegalaprofundar: talvez30/09OpenAI COOKEDaprofundar: talvez29/09Sonnet 5.5 Is Here. Look What It Can Build.aprofundar: talvez

todos os 42 vídeos de Matthew Berman no radar →