Sonnet 5.5 chegou: mesmo preço do GPT-6 Sol, e no esforço máximo sai mais caro que o Opus
A Anthropic manteve US$ 2 e US$ 10 por milhão de tokens, a mesma tabela da OpenAI para o GPT-6 Sol. Com o preço empatado, quem decide a conta é o nível de esforço, e os gráficos da própria Anthropic mostram onde o modelo barato deixa de ser barato.
A Anthropic lançou o Claude Sonnet 5.5 em 28 de setembro de 2026 pelo mesmo preço do Sonnet 5: US$ 2 por milhão de tokens de entrada, US$ 10 de saída e US$ 0,20 na leitura de cache, exatamente a tabela do GPT-6 Sol, da OpenAI. Nos números publicados pela Anthropic, ele supera o Sonnet 5 nos nove testes, passa o Opus 5.5 em trabalho de terminal (70,6% contra 66,4%) e em automação, e fica atrás dele nos outros sete. O que a manchete não mostra está nos gráficos de custo: em três das quatro provas com custo publicado, existe um nível do Opus 5.5 que tira nota maior que o melhor resultado do Sonnet 5.5 e custa menos por tarefa. O modelo compensa nos níveis de esforço baixo, médio e alto, não no máximo.
O que você leva deste artigo
- O identificador claude-sonnet-5-5 está no catálogo oficial da Anthropic desde 28 de setembro de 2026.
- Preço igual ao do Sonnet 5 e, centavo por centavo, ao do GPT-6 Sol: US$ 2 de entrada, US$ 10 de saída, US$ 0,20 na leitura de cache.
- Contra o Sonnet 5, ganha nos nove testes publicados. No Terminal-Bench 4.0, sai de 10,3% para 70,6%.
- Contra o Opus 5.5, vence dois testes (terminal e automação) e perde sete, a maioria por pouco.
- No esforço máximo ele gasta tanto token que, em três de quatro provas, um nível do Opus 5.5 faz nota maior por menos dinheiro.
- Quem usa tool_choice forçado precisa mudar o código antes de trocar o modelo: no Sonnet 5.5 isso devolve erro 400.
- Medição independente ainda é parcial: 75,5% no APEX-Agents, o maior resultado da prova, e 77,8 no LiveBench, abaixo do GPT-6 Sol.
O que saiu, e onde já dá para usar
O Claude Sonnet 5.5 saiu em 28 de setembro de 2026, seis dias depois do Opus 5.5 e do GPT-6 Sol, que a OpenAI lançou no mesmo 22 de setembro. É o segundo modelo da família 5.5 da Anthropic, e o Haiku 5.5, o menor e mais barato, foi prometido para as próximas semanas, sem data.
A confirmação é a de sempre, e não é print de tabela: o identificador claude-sonnet-5-5 está na documentação oficial, com preço publicado, e o modelo já roda na API da Anthropic, na Amazon Bedrock, no Google Cloud, no Microsoft Foundry e na Claude Platform on AWS. No mesmo dia entrou no GitHub Copilot, nos planos pagos (Pro, Pro+, Max, Business e Enterprise), cobrado a preço de tabela. No plano gratuito do Copilot ele não aparece.
A ficha técnica é a do irmão maior: janela de 1 milhão de tokens, até 128 mil tokens de resposta e conhecimento confiável até junho de 2026. A Anthropic o apresenta como o complemento rápido e barato do Opus 5.5, forte em tarefa bem delimitada, correção de bug e documento, apresentação e planilha. O Opus continua sendo, nas palavras da empresa, o modelo para trabalho aberto que exige julgamento por muito tempo.
Um detalhe curioso do anúncio: é o primeiro Sonnet a terminar Pokémon Red jogando só a partir de capturas de tela. Parece brincadeira, mas é um teste honesto de tarefa longa, em que o modelo precisa lembrar o que já fez e decidir o próximo passo por horas.
A tabela da Anthropic, com os nove testes
Duas leituras antes de olhar os números. A primeira é contra o Sonnet 5, e ali não há disputa: o modelo novo ganha nos nove testes, alguns com saltos que parecem erro de digitação. No Terminal-Bench 4.0, que mede trabalho longo em linha de comando, passou de 10,3% para 70,6%. No AutomationBench, da Zapier, de 10,7% para 44,7%. Na leitura de gráfico, de 15,6% para 61,6%.
A segunda é contra o Opus 5.5, que custa o dobro. O Sonnet 5.5 vence dois testes, terminal e automação, e perde sete, a maioria por pouco: dois pontos no GDPval-AA (1.844 contra 1.846) e 1,7 ponto no OSWorld 2.1. A maior distância é no SWE-Bench Pro, com 81,3% contra 89,9%. Mesmo a vitória no terminal pede cuidado: o próprio relatório técnico informa erro-padrão de 2,5 pontos para o Sonnet 5.5 e de 2,6 para o Opus 5.5 nessa prova, então a diferença de 4,2 pontos é tendência, não folga.
Contra o GPT-6 Sol, a Anthropic só tinha número em quatro linhas, e nas quatro o Sonnet 5.5 fica na frente. Uma ressalva que a própria Anthropic registra em nota: a OpenAI corrigiu recentemente um defeito que prejudicava a leitura de imagem do GPT-6 Sol, e parte das notas dele pode não refletir a correção.
| Sonnet 5.5 novo | Sonnet 5 | Opus 5.5 | GPT-6 Sol OpenAI | |
|---|---|---|---|---|
| Preço de entrada US$ por milhão de tokens | US$ 2 | US$ 2 | US$ 4 | US$ 2 |
| Preço de saída US$ por milhão de tokens | US$ 10 | US$ 10 | US$ 20 | US$ 10 |
| Leitura de cache US$ por milhão de tokens | US$ 0,20 | US$ 0,20 | US$ 0,20 | US$ 0,20 |
| Trabalho longo em terminal Terminal-Bench 4.0 | 70,6% | 10,3% | 66,4% | não publicado |
| Programação FrontierCode 1.1 | 52,1% | 42,4% | 54,4% | 49,3% |
| Programação CursorBench 4.0 | 55,5% | 34,1% | 57,8% | não publicado |
| Programação SWE-Bench Pro | 81,3% | 63,2% | 89,9% | não publicado |
| Trabalho de escritório GDPval-AA v2.1 | 1.844 | 1.449 | 1.846 | 1.487 |
| Automação AutomationBench | 44,7% | 10,7% | 42,5% | 32,0% |
| Uso de computador OSWorld 2.1 | 80,1% | 57,0% | 81,8% | não publicado |
| Conhecimento difícil Humanity's Last Exam, com ferramentas | 64,5% | 54,9% | 67,7% | não publicado |
| Leitura de gráfico Chartography | 61,6% | 15,6% | 64,4% | 53,6% |
Mesmo preço do GPT-6 Sol: a briga mudou de lugar
O Sonnet 5.5 custa o mesmo que o Sonnet 5: US$ 2 por milhão de tokens de entrada, US$ 10 de saída, US$ 0,20 na leitura de cache e US$ 2,50 na escrita de cache de cinco minutos. Em lote, metade. Vale lembrar que o Sonnet 5 tinha sido lançado com esse preço como promoção, com aumento marcado para US$ 3 e US$ 15 em 1º de setembro. O aumento não aconteceu: a tabela da Anthropic diz que o preço de lançamento virou o preço padrão.
A página de preços da OpenAI lista para o GPT-6 Sol exatamente os mesmos quatro números, centavo por centavo. Quando o token custa igual, a comparação muda de lugar e passa a ter duas perguntas: quantos tokens cada modelo queima para entregar o mesmo trabalho, e onde cada empresa cobra a mais.
A segunda pergunta tem resposta objetiva. A OpenAI dobra o preço de entrada e de cache e cobra 1,5 vez a saída, na requisição inteira, quando o pedido passa de 272 mil tokens. A Anthropic cobra a mesma tabela até 1 milhão. Para quem põe um contrato inteiro, um manual ou um repositório de código no pedido, essa linha pesa mais que a manchete.
Tem uma terceira sutileza: token não é a mesma unidade nas duas empresas. Cada uma corta o texto em pedaços de um jeito, e a própria Anthropic informa que o divisor de texto que ela usa desde o Opus 4.7 gera cerca de 30% mais tokens para o mesmo texto que o anterior (o Sonnet 5.5 manteve o do Sonnet 5). Preço igual por token não garante preço igual pelo mesmo texto. Se o assunto é novo para você, o artigo sobre o que é token e janela de contexto explica a conta.
Na primeira pergunta, os gráficos da Anthropic dão uma pista. No FrontierCode, medido pela Cognition, o Sonnet 5.5 no esforço alto faz 49,4% por US$ 0,42 por tarefa, e o melhor do GPT-6 Sol é 49,3% no máximo, por US$ 2,07. Mesma nota por um quinto do custo. Só que o gráfico é da Anthropic, e o teste independente mais amplo que já saiu, o LiveBench, põe o GPT-6 Sol na frente (mais sobre isso abaixo).
Quando duas empresas cobram o mesmo pelo token, preço deixa de ser argumento. O que sobra é quanto cada modelo gasta para entregar o mesmo trabalho.
A armadilha: no esforço máximo, o barato fica caro
Os modelos novos têm um botão de esforço, com cinco níveis: low, medium, high, xhigh e max. Mais esforço quer dizer mais raciocínio antes de responder, mais tokens e mais tempo. No aplicativo do Claude e no Claude Code, o padrão é medium. Na API, é high.
Junto com o anúncio, a Anthropic publicou a nota e o custo por tarefa de cada nível, para o Sonnet 5.5, o Opus 5.5, o Sonnet 5 e um modelo da OpenAI, em quatro provas. Lidos ponto a ponto, esses gráficos mostram uma coisa que o texto do anúncio não diz com essa clareza: no esforço máximo o Sonnet 5.5 gasta tanto token que, em três das quatro provas, existe um nível do Opus 5.5 com nota maior e custo menor por tarefa.
| Sonnet 5.5 medium | Sonnet 5.5 melhor nível | Opus 5.5 que empata ou supera | |
|---|---|---|---|
| Trabalho longo em terminal Terminal-Bench 4.0, custo por tentativa | 28,8% · US$ 0,83 | 70,6% · US$ 12,54 (max) | 66,4% · US$ 7,35 (xhigh, o melhor dele) |
| Programação FrontierCode 1.1 | 36,5% · US$ 0,24 | 52,1% · US$ 1,59 (xhigh) | 54,6% · US$ 0,80 (medium) |
| Programação CursorBench 4.0 | 39,2% · US$ 0,70 | 55,5% · US$ 9,67 (max) | 56,0% · US$ 3,97 (high) |
| Projetos longos de escritório AA-Briefcase v1.1, nota Elo | 1.461 · US$ 1,64 | 1.811 · US$ 29,19 (max) | 1.822 · US$ 21,05 (max) |
O caso mais claro é o CursorBench, que usa tarefas de sessões reais do editor Cursor. O melhor do Sonnet 5.5 é 55,5% por US$ 9,67 por tarefa. O Opus 5.5 no esforço alto faz 56,0% por US$ 3,97, menos da metade. No AA-Briefcase, o Sonnet no máximo chega a 1.811 pontos gastando US$ 29,19 por tarefa, e o Opus no máximo faz 1.822 por US$ 21,05. No FrontierCode, o Opus no nível médio passa o melhor do Sonnet pela metade do preço.
Comparando nível com nível, o Sonnet 5.5 é o mais barato dos dois do low ao xhigh, nas quatro provas. É no max que a ordem se inverte: ali ele custa mais por tarefa que o próprio Opus 5.5 no max em três das quatro, e no FrontierCode a diferença é de US$ 20,78 contra US$ 6,19.
A exceção é o Terminal-Bench, onde o Sonnet 5.5 no máximo faz 70,6%, acima de qualquer nível do Opus, pagando US$ 12,54 por tentativa contra US$ 7,35 do melhor Opus. E vale olhar a primeira coluna com atenção: no nível médio, que é o padrão do aplicativo, o Sonnet 5.5 faz 28,8% nessa prova, contra 57,6% do Opus 5.5 no mesmo nível.
A Anthropic diz isso do jeito dela: o Sonnet complementa melhor o Opus nos níveis baixos, e nos altos entrega resultado parecido por custo parecido. Os mesmos pontos permitem uma leitura mais dura, porque em três de quatro provas o custo não é parecido, é maior. E tempo também é custo. No teste de perguntas de profissionais de saúde do relatório técnico, a resposta levou de 12 a 26 segundos do low ao xhigh e cerca de 160 segundos no max, para ganhar entre 1 e 1,6 ponto, dentro da margem de ruído.
Os depoimentos de clientes escolhidos pela Anthropic apontam na mesma direção, a do uso em volume. A Balyasny, gestora de investimentos, relatou cerca de 121 mil tokens por resposta em 2.441 tarefas de finanças, contra 497 mil do Sonnet 5. A Base44 contou 3,6 rodadas por aplicativo construído, contra 7,7 do Opus 5, em 118 aplicativos. São números de quem foi convidado a testar antes, mas mostram onde está o ganho: fazer o mesmo com menos passos.
Preço por token é o que está na tabela. Preço por tarefa é o que chega na fatura, e ele depende mais do botão de esforço do que do nome do modelo.
O que já foi medido fora da Anthropic
Tudo até aqui foi publicado por quem vende. Algumas provas foram rodadas por terceiros, como Cursor, Cognition e Zapier, mas quem escolheu quais mostrar foi a Anthropic. O nosso AI Benchmark reúne medições que não dependem do fabricante, e o Sonnet 5.5 entrou nele sozinho na manhã seguinte ao lançamento, na primeira apuração depois que a Epoch AI o cadastrou. Até esta publicação, o que existe é isto:
| Sonnet 5.5 novo | Opus 5.5 | GPT-6 Sol OpenAI | Sonnet 5 | |
|---|---|---|---|---|
| Média geral, 23 tarefas LiveBench, de 0 a 100 | 77,8 | 83,2 | 79,3 | 76,0 |
| Trabalho de escritório com agentes APEX-Agents | 75,5% | 73,5% | 54,3% | 54,5% |
| Programação científica SciCode | 61,0% | 66,9% | 57,6% | 53,6% |
| Física de pesquisa CritPt | 31,4% | 31,7% | 30,9% | 16,9% |
O dado mais forte a favor do modelo é o APEX-Agents, que mede trabalho de escritório executado por agente: 75,5%, o maior resultado já registrado na prova, acima do Opus 5.5 (73,5%) e muito acima do GPT-6 Sol (54,3%). Bate com a história que o fabricante conta: o salto está no trabalho com ferramentas, em várias etapas.
O LiveBench, que é o teste amplo, conta outra coisa: 77,8, só 1,7 ponto acima do Sonnet 5 e abaixo do GPT-6 Sol. E o número parece instável. No esforço máximo o Sonnet 5.5 fez 75,7, menos que no xhigh e menos que o Sonnet 5, e a categoria de programação com agentes oscila de 56,3 no max para 39,3 no xhigh, quando o Sonnet 5 tinha 59,4. Isso não combina com nenhuma outra medição do modelo. Vale ler como provisório até a próxima atualização do LiveBench.
Ainda faltam as duas medições que o AI Benchmark usa para posicionar um modelo: o índice composto da Epoch AI (ECI) e a nota de preferência humana da Arena. É normal: as duas costumam sair dias depois do lançamento. Quando saírem, o modelo sobe sozinho para o ranking, sem ninguém digitar número.
O que quebra no código de quem já usa o Sonnet 5
Trocar o nome do modelo na configuração não basta. A documentação lista cinco mudanças que derrubam código escrito para o Sonnet 5, e duas delas atingem integrações comuns, como atendimento automático e extração de dados.
A mais séria é o fim da ferramenta forçada. Muito sistema usa tool_choice do tipo any ou tool para obrigar o modelo a devolver a resposta num formato fixo, como nome, telefone e intenção do cliente. No Sonnet 5.5 esse pedido volta com erro 400. O substituto oficial é deixar auto e ligar o modo estrito da ferramenta, ou usar saída estruturada, dizendo no prompt quando a ferramenta deve ser usada.
- Ferramenta forçada:
tool_choicecomanyoutooldevolve erro 400. Useautocom modo estrito. - Pensamento desligado:
disableddeixou de existir e dá erro. O menor nível agora ébetween_tools, aceito só até o esforço high. - Histórico editado: o raciocínio fica amarrado ao modelo e à conversa. Em conta criada a partir de 31 de agosto de 2026, reenviar um bloco de raciocínio depois de mudar o prompt de sistema, as ferramentas ou uma mensagem anterior devolve erro 400. A conversa precisa só crescer, nunca ser reescrita.
- Uso de computador: na API da Anthropic e no Google Cloud, a ferramenta antiga
computer_20251124não é aceita. É preciso migrar para o novo conjunto de ferramentas. - Modelo conselheiro: a ferramenta de conselheiro não aceita mais o Opus 4.8, o Opus 4.7 nem o Sonnet 5 nesse papel.
E há uma mudança que não dá erro nenhum, que é a mais traiçoeira: o texto que o modelo escreve entre uma chamada de ferramenta e outra agora volta dentro de blocos de raciocínio, vazios por padrão. Uma tela que mostrava "estou consultando o estoque" para o cliente fica muda, sem alarme. A correção é uma linha de configuração, mas só quem sabe do problema procura por ela.
A documentação também avisa que os níveis de esforço foram recalibrados: o medium do Sonnet 5.5 não pensa o mesmo que o medium do Sonnet 5. Levar a configuração antiga direto para o modelo novo é a forma mais rápida de pagar diferente sem perceber.
Segurança, e o que o próprio relatório admite
É o primeiro Sonnet lançado com as travas de cibersegurança dos modelos mais fortes da casa, porque a capacidade dele nessa área ficou parecida com a do Opus 5. Na prática, corrigir bug no dia a dia continua normal, mas pedidos de segurança de alto risco caem, de forma visível, para o Sonnet 5. Também é o primeiro Sonnet com bloqueio contra quem tenta extrair o raciocínio do modelo para treinar um concorrente.
O relatório técnico tem 148 páginas e traz achados menos lisonjeiros, que vale repetir. Num teste de conhecimento sem consulta, o Sonnet 5.5 acerta mais que o Sonnet 5, mas fica um pouco mais propenso a afirmar uma resposta errada em vez de dizer que não sabe, e no saldo só fica à frente do Sonnet 5 entre os modelos Claude comparados. O texto do raciocínio é menos legível que o dos modelos recentes. E a calidez e o humor saíram um pouco abaixo dos do Sonnet 5.
Do lado bom, na auditoria automática de comportamento, com cerca de 1.850 cenários, ele empata ou melhora em relação ao Sonnet 5 na maior parte das medidas, tem a menor taxa de tentativa de sair do ambiente isolado entre os modelos testados e é o Sonnet mais resistente a instruções maliciosas escondidas em páginas e arquivos, sobretudo em código e navegador. A ressalva de sempre: quem mediu foi quem vende. Para um agente que mexe em sistema de verdade, permissão apertada continua valendo mais que bom comportamento.
O que fazer esta semana
Se você usa IA pelo aplicativo, num plano mensal, a notícia é boa e não exige nada: o modelo do meio ficou mais rápido e bem mais capaz. Você não escolhe modelo por preço de token.
Se você construiu alguma coisa que chama a API, a conta mudou de forma, e as decisões cabem em cinco linhas.
- Antes de trocar o modelo, procure
tool_choiceforçado ethinkingdesligado no seu código. Os dois viram erro 400 no Sonnet 5.5. - Não copie o nível de esforço do Sonnet 5. Refaça o teste: a documentação sugere começar por high no geral, por medium em agente com tarefa bem definida e por low ou medium em chat.
- Antes de subir o Sonnet 5.5 para xhigh ou max, rode as mesmas tarefas no Opus 5.5 em medium ou high. Pelos gráficos da própria Anthropic, pode sair melhor e mais barato.
- Se a dúvida era entre Sonnet e GPT-6 Sol por causa do preço, o preço empatou. Compare o custo por tarefa com as suas tarefas, e confira se os seus pedidos passam de 272 mil tokens, onde a OpenAI cobra mais.
- Se a tarefa é simples e de alto volume, como classificar, resumir e extrair, meça no low. E considere esperar o Haiku 5.5 antes de migrar duas vezes.
Nenhuma dessas decisões se resolve lendo benchmark, inclusive este texto. Elas se resolvem rodando dez tarefas reais suas nos modelos candidatos e olhando duas colunas: acerto e custo. É uma tarde de trabalho, e ela vale mais que qualquer tabela de lançamento.
O que ainda não dá para dizer
Primeiro, a posição do Sonnet 5.5 entre os modelos. Sem o ECI da Epoch AI e sem a nota da Arena, o que existe de independente são algumas provas soltas e um LiveBench com cara de provisório. É pouco para dizer se ele passa ou não o GPT-6 Sol no uso geral.
Segundo, o que muda no aplicativo do Claude. A Anthropic não detalhou, até esta publicação, quais planos passam a usar o Sonnet 5.5 como padrão. Pela API e pelas nuvens ele está disponível para todos desde o primeiro dia.
Terceiro, o Haiku 5.5. É ele que define o preço da faixa barata, a que roda triagem, resumo e atendimento em volume. Semana passada, o Opus 5.5 derrubou o preço do topo. Esta semana, o Sonnet 5.5 manteve o do meio e subiu a entrega. Se o Haiku repetir o movimento, a conta de quem roda volume muda mais do que mudou até agora.
Perguntas frequentes
O Sonnet 5.5 é melhor que o Opus 5.5?
No geral, não. Na tabela da Anthropic, o Sonnet 5.5 vence dois dos nove testes (trabalho em terminal e automação) e perde sete, a maioria por pouco, e a própria empresa diz que o Opus 5.5 continua mais forte em trabalho aberto e longo. Numa medição independente, o APEX-Agents, o Sonnet 5.5 fez 75,5% contra 73,5% do Opus 5.5. Ele custa metade por token: US$ 2 e US$ 10, contra US$ 4 e US$ 20.
Quanto custa o Sonnet 5.5?
US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de saída. A leitura de cache custa US$ 0,20, a escrita de cache US$ 2,50 (cinco minutos) ou US$ 4 (uma hora), e o processamento em lote sai pela metade: US$ 1 e US$ 5. É o mesmo preço do Sonnet 5, e vale para a janela inteira de 1 milhão de tokens.
Sonnet 5.5 ou GPT-6 Sol: qual escolher?
O preço por token é idêntico: US$ 2 de entrada, US$ 10 de saída e US$ 0,20 de cache nos dois. Nos testes publicados pela Anthropic, o Sonnet 5.5 fica na frente nos quatro em que há número dos dois. No LiveBench, que é independente, o GPT-6 Sol fica na frente, com 79,3 contra 77,8. Acima de 272 mil tokens por pedido, a OpenAI cobra mais caro, e a Anthropic não. A escolha certa sai de rodar as suas próprias tarefas nos dois e comparar acerto e custo por tarefa.
Por que o Sonnet 5.5 no esforço máximo pode custar mais que o Opus 5.5?
Porque no máximo ele usa muito mais tokens. No CursorBench, o Sonnet 5.5 gastou em média 271.920 tokens por tarefa no max, contra 37.391 no high, mais de sete vezes, para subir de 47,8% para 55,5%. Com isso, o Opus 5.5 no esforço alto faz 56,0% por US$ 3,97 por tarefa, enquanto o melhor do Sonnet 5.5 custa US$ 9,67. Comparando nível com nível, o Sonnet é o mais barato dos dois do low ao xhigh; é no max que ele passa a custar mais.
Preciso mudar meu código para usar o Sonnet 5.5?
Se o seu código usa ferramenta forçada (tool_choice any ou tool), desliga o pensamento com disabled, edita o histórico da conversa antes de reenviar, usa a ferramenta antiga de uso de computador ou o Sonnet 5 como conselheiro, sim: esses casos devolvem erro 400. Fora isso, basta trocar o identificador para claude-sonnet-5-5 e refazer o teste de nível de esforço, porque os níveis foram recalibrados.
O Sonnet 5.5 já está no AI Benchmark da ROO3?
Sim, desde a manhã seguinte ao lançamento, quando a Epoch AI o cadastrou, e sem nenhum número do fabricante. Ele aparece como lançamento recente, com a média do LiveBench e as provas individuais que a Epoch AI já publicou, cada uma ao lado do melhor resultado da prova. Ainda não tem posição no ranking, que é ordenado pelo índice composto da Epoch AI. Quando esse índice sair, ele entra sozinho na posição que o número der.
Quando sai o Haiku 5.5?
A Anthropic disse apenas que o Haiku 5.5, feito para uso em alto volume e sensível a custo, entra na família 5.5 nas próximas semanas. Não há data nem preço publicados. Até lá, o Haiku atual é o 4.5, a US$ 1 e US$ 5 por milhão de tokens.
- Anthropic, anúncio do Claude Sonnet 5.5 (tabela de benchmarks, gráficos de nota por custo e preços)
- Anthropic, System Card do Claude Sonnet 5.5 (relatório técnico de 148 páginas)
- Claude Platform Docs, What's new in Claude Sonnet 5.5 (mudanças que quebram código)
- Claude Platform Docs, Pricing (tabela oficial de preços da Anthropic)
- OpenAI, API pricing (preço do GPT-6 Sol, incluindo contexto longo)
- GitHub Changelog, Claude Sonnet 5.5 in GitHub Copilot
- LiveBench, ranking e licença CC BY-SA 4.0
- Epoch AI, dados de benchmark (APEX-Agents, SciCode e CritPt, sob CC BY 4.0)
Rodrigo Fávaro
Fundador da ROO3, agência de marketing e tecnologia em São José do Rio Preto. Constrói produtos com IA em produção (Tobia, gerar.app, Pense Mercado) e mantém o AI Benchmark, ranking público de modelos de IA. Veja a consultoria em IA da ROO3.
X @rodmf LinkedIn rodrigofavaroContinue lendo

Opus 5.5: o caro ficou melhor e mais barato ao mesmo tempo
Os benchmarks oficiais do Claude Opus 5.5 contra Fable 5.1, Opus 5 e GPT-6 Astra, o preço por token, a queda de 60%...
11 min de leitura
Grok 4.7: o mais barato da mesa ganha em dois testes de sete
Os benchmarks oficiais do Grok 4.7 contra GPT-5.6 Sol e Claude Fable 5.1, o preço por token, a letra miúda que dobra...
8 min de leitura
Qual a melhor IA hoje: como comparar sem seguir opinião
Como comparar modelos de IA usando medição pública em vez de opinião: o que é o ECI da Epoch AI, o que é o ELO da Arena...
9 min de leituraQuer aplicar isso na sua empresa?
A ROO3 faz o diagnóstico do que dá para automatizar primeiro no seu negócio. A conversa inicial é gratuita.