Radar

radar · IA & agentes

OpenRouter State Of Models: Jev, Open-Weights, and Tokenomics

a tese

IndyDevDan usa os dados públicos do OpenRouter para mapear cinco tendências do mercado de modelos no último trimestre de 2026: o consumo de tokens cresce quase exponencialmente, não há um vencedor único, surgiu uma nova classe de modelos classificadores liderada pelo Jev, token grátis cobra o preço dos seus dados, e possuir o próprio harness de agente é vantagem competitiva.

aprofundar

talvez

a ideia de usar modelo classificador barato para rotear decisões dentro do agente é aproveitável nas automações do Bruno, e a crítica de tokenomics é sóbria, mas os números macroeconômicos do vídeo são de guardanapo e há inconsistência no próprio fechamento (146 trilhões no início, 445 trilhões no fim), então nada aqui deve ser citado como dado.

O que foi dito

  • O número de abertura é o argumento central: há um ano o OpenRouter processava 4,5 trilhões de tokens por semana, e na semana passada foram 146 trilhões. Ele usa isso contra a tese da bolha, porque é demanda medível, não promessa.
  • A ressalva metodológica que ele mesmo levanta é importante: o OpenRouter não conta tokens que passam direto pelos provedores, de modo que a Anthropic aparece em sétimo lugar sem que isso signifique pouco uso, já que o tráfego corporativo vai direto para os laboratórios.
  • Ele monta um cálculo de guardanapo para estimar o volume da Anthropic a partir de um faturamento anualizado rumorado de 60 bilhões de dólares, e chega a 65 trilhões de tokens por dia, número que não sobrevive a conferência (a esse preço, 60 bilhões por ano daria ordem de alguns trilhões de tokens por ano, não por dia). O ponto qualitativo dele pode estar certo, a aritmética não está, e ele próprio diz que se pode cortar o número pela metade duas vezes sem mudar a conclusão.
  • O enquadramento financeiro é explícito: a Anthropic busca abertura de capital avaliada em 2 trilhões de dólares projetando 200 bilhões de receita anualizada até 2028, e ele vê a pergunta real como se o crescimento de uso se mantém. Se mantiver, não há bolha, se não, o cenário pessimista se confirma e a OpenAI vem atrás.
  • Sobre quem está ganhando a corrida, a resposta dele é que todos estão: o pódio semanal no OpenRouter é sempre DeepSeek, OpenAI e Google, e ele defende que o Gemini Flash é o modelo de trabalho com a melhor relação entre desempenho, velocidade e custo, sendo o padrão do agente de código dele.
  • Há um circuito que ele chama de otimização circular: os laboratórios de fronteira pavimentam o caminho, os modelos de peso aberto chineses tornam o uso barato, e esses modelos são treinados por destilação do estado da arte, de modo que custo cai e inteligência sobe para o engenheiro.
  • A novidade da semana é o Jev, da Typesafe, classificador zero-shot que ele trata como nova espécie de modelo, não como substituto de modelo de linguagem. Cresceu 200% até 2,68 trilhões de tokens e entrou no décimo segundo lugar consumindo uma fração dos tokens de um modelo de linguagem dentro de agentes.
  • O argumento dele contra os clones do Jev é de engenharia, não de capacidade bruta: com dados de treino próprios é possível superá-lo num caso específico, mas não em muitos casos ao mesmo tempo, e o que ninguém replicou é a latência consistente e o tempo de atividade, área em que ele diz que os grandes laboratórios ficam atrás (menciona uma queda do Claude durante a própria gravação). Ele afirma economizar cerca de 20% do gasto de tokens embutindo o Jev no agente.
  • O conselho sobre modelos gratuitos é direto: se é grátis, você é o produto, ele não acredita na promessa de não treinar com os prompts e prefere pagar a entregar informação proprietária, embora reconheça que o fenômeno confirma a tendência de que preço baixo gera uso.
  • A tese final é sobre propriedade da ferramenta: ele acompanha a posição do agente dele frente ao Claude Code no ranking de aplicações do OpenRouter, prevê ultrapassagem até dezembro, e argumenta que alugamos inteligência o bastante, de modo que possuir e customizar o harness do agente é a vantagem que outros engenheiros não têm. Ele próprio reconhece que o número do Claude Code é muito maior se contadas as assinaturas, que não passam pelo OpenRouter.

Mais de IndyDevDan

12 no radar
28/0910 Levels of Jev For Agentic Engineersaprofundar: sim21/09Self-Compact Pi Agent: ZERO HYPE Agentic Coding Devlogaprofundar: talvez14/09Agentic Engineering Benchmarks: How I RANK Astra, Fable 5.1, and Open-Weightsaprofundar: talvez07/09Are Agent Swarms USEFUL? OpenAI’s GPT-6 Astra SWARM Takeawaysaprofundar: talvez31/08Agentic Engineering Operating Level: WHERE to FOCUS your AGENTS?aprofundar: talvez

todos os 12 vídeos de IndyDevDan no radar →