a tese
O lançamento do modelo open-source Kimmy K3 (2,8T, 1M tokens, multimodal) muda a dinâmica competitiva da IA: reduz custo por inteligência, fortalece ecossistemas open-source e motiva respostas regulatórias dos EUA que podem proteger os labs fechados.
aprofundar
sim
Relevante para Bruno: implicações técnicas (context window/efficiency), econômicas (custo por tarefa, Jevons) e políticas (controle de ecossistema, regulação transnacional) afetam design e governança de agentes inteligentes.
O que foi dito
- Kimmy K3 (Moonshot) anunciado como modelo frontier open-source: 2,8 trilhões de parâmetros, contexto de 1 milhão de tokens, nativamente multimodal, comparável a GPT‑5.6 e Fable; China distribuindo modelos de alto nível gratuitamente.
- Distinção aberto vs fechado: OpenAI e Anthropic são labs fechados que controlam disponibilidade e preços; empresas chinesas (Deepseek, Moonshot, Alibaba/Quen) tendem a open-source e a “dar” modelos para ganhar padrão/ecossistema.
- Motivações chinesas: estratégia de scorched earth (preço/subsídio para dominar padrão), controle de ecossistema, subsídios estatais e vantagem geopolítica (chips/infraestrutura).
- Economia da camada modelo: custo por token ≠ custo por tarefa; exemplo de preços citados (Kimmy ≈ $3 input/$15 output por milhão vs GPT5.6 $5/$30) mas Kimmy usa ~duas vezes mais tokens, logo métrica relevante é custo por tarefa; menção a Ben Thompson e ao argumento técnico-econômico.
- Efeitos para o resto da pilha: open-source reduz margens na camada de modelo, beneficiando chips, data centers, provedores de inference e software (paradoxo de Jevons/Javon citado: tokens mais baratos → uso maior). Gavin Baker citado defendendo que múltiplas opções incentivam competição.
- Riscos de segurança e regulação: Axios noticiou que administração americana considera banir modelos chineses; preocupações sobre guardrails, uso em cibersegurança (ex.: Hugging Face/Clem relata que modelos fechados bloquearam payloads enquanto GLM 5.2 local respondeu), e argumento de Dean W. Ball (OpenAI) sobre open-weights serem “decelerationist” sem justificativa clara.
- Acusações de distillation attack: Anthropic acusou Moonshot/Deepseek de extrair respostas de Claude/GPT para treinar seus modelos; há complexidade legal e jurisdicional sobre processar empresas chinesas; autor conclui ser favorável ao open-source com cautela regulatória, defendendo competição em todas as camadas.