Radar

radar · IA & agentes

The Most Important Conversation in AI Right Now

a tese

O lançamento do modelo open-source Kimmy K3 (2,8T, 1M tokens, multimodal) muda a dinâmica competitiva da IA: reduz custo por inteligência, fortalece ecossistemas open-source e motiva respostas regulatórias dos EUA que podem proteger os labs fechados.

aprofundar

sim

Relevante para Bruno: implicações técnicas (context window/efficiency), econômicas (custo por tarefa, Jevons) e políticas (controle de ecossistema, regulação transnacional) afetam design e governança de agentes inteligentes.

O que foi dito

  • Kimmy K3 (Moonshot) anunciado como modelo frontier open-source: 2,8 trilhões de parâmetros, contexto de 1 milhão de tokens, nativamente multimodal, comparável a GPT‑5.6 e Fable; China distribuindo modelos de alto nível gratuitamente.
  • Distinção aberto vs fechado: OpenAI e Anthropic são labs fechados que controlam disponibilidade e preços; empresas chinesas (Deepseek, Moonshot, Alibaba/Quen) tendem a open-source e a “dar” modelos para ganhar padrão/ecossistema.
  • Motivações chinesas: estratégia de scorched earth (preço/subsídio para dominar padrão), controle de ecossistema, subsídios estatais e vantagem geopolítica (chips/infraestrutura).
  • Economia da camada modelo: custo por token ≠ custo por tarefa; exemplo de preços citados (Kimmy ≈ $3 input/$15 output por milhão vs GPT5.6 $5/$30) mas Kimmy usa ~duas vezes mais tokens, logo métrica relevante é custo por tarefa; menção a Ben Thompson e ao argumento técnico-econômico.
  • Efeitos para o resto da pilha: open-source reduz margens na camada de modelo, beneficiando chips, data centers, provedores de inference e software (paradoxo de Jevons/Javon citado: tokens mais baratos → uso maior). Gavin Baker citado defendendo que múltiplas opções incentivam competição.
  • Riscos de segurança e regulação: Axios noticiou que administração americana considera banir modelos chineses; preocupações sobre guardrails, uso em cibersegurança (ex.: Hugging Face/Clem relata que modelos fechados bloquearam payloads enquanto GLM 5.2 local respondeu), e argumento de Dean W. Ball (OpenAI) sobre open-weights serem “decelerationist” sem justificativa clara.
  • Acusações de distillation attack: Anthropic acusou Moonshot/Deepseek de extrair respostas de Claude/GPT para treinar seus modelos; há complexidade legal e jurisdicional sobre processar empresas chinesas; autor conclui ser favorável ao open-source com cautela regulatória, defendendo competição em todas as camadas.

Mais de Matthew Berman

11 no radar
11/08Mark Zuckerberg just called out Dario (and Anthropic)aprofundar: talvez07/08What is Google even doing?aprofundar: talvez05/08Master Codex with these 15 Tipsaprofundar: talvez04/08Open-source is WINNINGaprofundar: não31/07GPT-5.6 just made itself better...aprofundar: não

todos os 11 vídeos de Matthew Berman no radar →