Radar

radar · IA & agentes

OpenAI COOKED

a tese

Matthew Berman cobre o DevDay da OpenAI que assistiu presencialmente e organiza os anúncios em torno de uma leitura: a OpenAI está seguindo o padrão já estabelecido por concorrentes, assistente pessoal sempre ligado no molde do OpenClaw e modelo barato pós-treinado que chega quase ao nível do carro-chefe.

aprofundar

talvez

é cobertura de lançamento, não análise, e o entusiasmo é do gênero do canal, mas dois pontos servem ao trabalho do Bruno com agentes: a confirmação de que o padrão de assistente pessoal sempre ligado veio do OpenClaw, que ele acompanha no laboratório de Agentes, e a economia de preço do pós-treino, que define qual modelo vale usar em cada rotina.

O que foi dito

  • Maior anúncio do dia, o Dots, assistente pessoal sempre ativo, proativo, que tenta antecipar a tarefa antes do pedido e roda em nuvem com acesso a Gmail, Google Docs, calendário e afins, acessível pelo ChatGPT, Slack e Teams.
  • Berman credita explicitamente a Peter Steinberger e ao OpenClaw a definição do padrão que Dots, Grokbot, Muse e Instinct agora seguem, e observa que todos convergiram até na identidade visual, formas geométricas macias com olhos.
  • Critica a arquitetura escolhida: Dots vive dentro do app do ChatGPT e controla as threads de ChatGPT e Codex do usuário, em vez de ser aplicativo próprio; conversas com o Dots não consomem cota, mas as threads que ele dispara consomem.
  • Ultrafast, o GPT-6 Astra rodando em chips Cerebras, oito vezes mais rápido que nas GPUs Nvidia e seis vezes mais caro; ele diz ter queimado mil dólares em cerca de uma hora e meia com acesso antecipado.
  • Novo plano Pro500, de 500 dólares mensais, com limite 25 vezes o do Plus, enquanto o plano de 200 dólares caiu de 20x para 10x, o que ele lê como pagar bem mais por pouco mais.
  • Responde à objeção de que IA estaria encarecendo: a mesma inteligência que hoje custa centavos por milhão de tokens custava dezenas de dólares um ano atrás, então o preço da inteligência cai, mas a fronteira absoluta cobra caro por velocidade e qualidade.
  • GPT-6.1 Soul é, para ele, o anúncio mais impressionante: praticamente tão bom quanto o Astra por 2 dólares o milhão de tokens de entrada e 10 de saída, contra 10 e 50 do Astra, com cache a 10 centavos.
  • Lê isso como convergência entre laboratórios: Anthropic e OpenAI teriam resolvido o pós-treino ao mesmo tempo, destilando modelos gigantes (Fable, Astra) em modelos menores, quase equivalentes e muito mais baratos de servir, o mesmo movimento do Sonnet 5.5 em relação ao Opus 5.5.
  • Mostra o Soul empatando ou superando o Astra no benchmark que ele considera o mais representativo da opinião de desenvolvedores, e ficando atrás apenas no topo do OSWorld, de uso de computador.
  • Outros anúncios: Codex Security Cloud, que varre o código continuamente em busca de vulnerabilidades; Codex nativo em nuvem, que ele defende como o modo certo de programar; nova CLI com controle por voz; nova experiência de revisão de código.
  • Prévia da Decisions API, modelo leve para decisões rápidas baseado no Luna, que ele compara ao Jev e aposta que perderá em velocidade por ser modelo reaproveitado e não construído do zero para decidir.
  • Relançamento dos plugins ou apps dentro do ChatGPT, agora com login “sign in with ChatGPT” em terceiros e portabilidade dos tokens da assinatura para esses aplicativos, o que ele acha generoso e diz que a Anthropic não faria, mais o ChatGPT Space, área de trabalho colaborativa com agentes no molde do Notion.

Mais de Matthew Berman

42 no radar
10/10Everything has been solvedaprofundar: não07/10Mistral is BACK! (Le Chonk)aprofundar: talvez07/1012 Grok Bot Use Cases That Feel Illegalaprofundar: talvez29/09Sonnet 5.5 Is Here. Look What It Can Build.aprofundar: talvez24/098 Jev Use Cases That Feel Like Cheatingaprofundar: não

todos os 42 vídeos de Matthew Berman no radar →