---
title: "Claude Opus 5.5: preços e comparação de desempenho"
locale: pt
category: ai_data
category_name: "Dados de IA"
translation_status: reviewed
license: cc_by
author: "injoys"
source_url: https://injoys.com/en/articles/claude-opus-5-5-pricing-performance-comparison
published_at: 2026-10-02T10:07:05+09:00
---

# Claude Opus 5.5: preços e comparação de desempenho

> O Claude Opus 5.5 reduziu os preços padrão por token de entrada e saída em 20% em relação ao Opus 5. A redução de 40% no custo das tarefas é resultado de uma avaliação da Anthropic; o custo real depende da quantidade de tokens usados e do uso do cache.

## Key Points

- Os preços padrão do Claude Opus 5.5 por 1 milhão de tokens são de US$ 4 para entrada e US$ 20 para saída.
- O preço da leitura do cache é de US$ 0.20 por 1 milhão de tokens, 60% menor que o do Opus 5.
- Segundo os dados divulgados pela Anthropic, a pontuação no Terminal-Bench 4.0 subiu de 52.3% para 66.4%.
- A redução de cerca de 85% nas tentativas de contornar limites foi observada em uma avaliação específica de segurança.
- Para migrar a API existente, revise o nome do modelo e as configurações de inferência e de chamadas de ferramentas.

O Claude Opus 5.5 tem preços padrão por token 20% menores. Suas pontuações nas avaliações de programação e uso do computador também aumentaram. A redução de 40% no custo por tarefa é um resultado dos testes da Anthropic.

Os preços e as pontuações das avaliações se baseiam no anúncio da Anthropic de 22 de setembro de 2026.

## Comparação de preços do Claude Opus 5.5

As tarifas padrão da API são de 4 dólares por 1 milhão de tokens de entrada e 20 dólares por 1 milhão de tokens de saída. Tokens são as unidades usadas pelo modelo para processar textos e outros conteúdos. Entrada é o conteúdo enviado ao modelo; saída é o conteúdo gerado por ele.

| Item cobrado | Opus 5 | Opus 5.5 | Redução do preço unitário |
| --- | ---: | ---: | ---: |
| 1 milhão de tokens de entrada comum | 5 dólares | 4 dólares | 20% |
| 1 milhão de tokens de saída | 25 dólares | 20 dólares | 20% |
| 1 milhão de tokens lidos do cache | 0.50 dólar | 0.20 dólar | 60% |

Os valores estão em dólares americanos. O cache armazena entradas usadas repetidamente para reutilizá-las. O custo de criação do cache é calculado separadamente do custo de leitura.

## Condições para a redução de 40% no custo por tarefa

Os 40% não são um desconto aplicado a todas as solicitações. São uma estimativa de economia calculada pela Anthropic para tarefas comuns com as configurações padrão. Ela considera tanto os preços unitários menores quanto a redução no uso de tokens por tarefa.

| Condição de uso | O que determina o custo | O que verificar |
| --- | --- | --- |
| Inserção de conteúdo novo a cada vez | Uso de entrada e saída comuns | Quantidade real de tokens em cada item |
| Uso repetido dos mesmos documentos ou instruções | Criação e leitura do cache | Se o cache foi de fato reutilizado |
| Agente de programação que executa várias etapas | Chamadas repetidas e novas tentativas | Custo total até a conclusão da tarefa |
| Assinatura mensal | Preço e limites de uso da assinatura | Diferença entre o preço por token e o valor da assinatura |

A redução dos preços unitários da API não significa, por si só, uma redução no valor da assinatura mensal. Para saber quanto seu serviço pode economizar, compare o uso na mesma tarefa. A [página da Anthropic sobre o Opus](https://www.anthropic.com/claude/opus) também descreve os 40% como uma estimativa para tarefas cobradas por token.

## Exemplo de cálculo

Se forem usados 1 milhão de tokens de entrada e 1 milhão de tokens de saída, o custo padrão será de 24 dólares. Para a comparação, considera-se que o uso seja igual nos dois modelos. O cálculo exclui o cache e os custos de ferramentas cobrados separadamente.

| Item do cálculo | Opus 5 | Opus 5.5 |
| --- | ---: | ---: |
| 1 milhão de tokens de entrada comum | 5 dólares | 4 dólares |
| 1 milhão de tokens de saída | 25 dólares | 20 dólares |
| Total | 30 dólares | 24 dólares |

A diferença é de 6 dólares, uma economia de 20%. Esse cálculo não inclui o efeito da redução de tokens por tarefa. Por isso, o resultado baseado apenas nos preços unitários difere dos 40% anunciados.

A diferença para a leitura de 1 milhão de tokens do cache é de 0.30 dólar. No entanto, esse valor compara apenas o item de leitura. A cobrança total também deve considerar a criação do cache e os custos dos demais tokens.

## Desempenho na programação com agentes e no uso do computador

No anúncio da Anthropic, as pontuações de programação e uso do computador aumentaram. A programação com agentes usa ferramentas para realizar tarefas de desenvolvimento em várias etapas. O uso do computador é a capacidade de observar a tela e operar a interface.

| Avaliação | Opus 5 | Opus 5.5 | Diferença na pontuação |
| --- | ---: | ---: | ---: |
| Terminal-Bench 4.0 | 52.3% | 66.4% | 14.1 pontos percentuais |
| CursorBench 4.0 | 46.6% | 57.8% | 11.2 pontos percentuais |
| OSWorld 2.1 | 74.0% | 81.8% | 7.8 pontos percentuais |

O nome da avaliação no anúncio oficial é OSWorld 2.1. Essa pontuação vem acompanhada da indicação `partial`. É preciso manter a versão e a indicação da pontuação para não confundi-la com outros resultados.

O resultado do Opus 5.5 no Terminal-Bench 4.0 usa a configuração `xhigh`. As condições da avaliação não são as mesmas da estimativa de custo com as configurações padrão apresentada no anúncio. O aumento da pontuação, por si só, não permite calcular a taxa de sucesso em projetos reais.

## Mudanças na velocidade e na escrita

A Anthropic anunciou que a velocidade de geração da saída aumentou mais de 30% em relação ao Opus 5. Esse número se refere à velocidade com que o texto é gerado. A redução no tempo da tarefa completa, incluindo buscas e testes, precisa ser medida separadamente.

Segundo a Anthropic, a escrita foi aprimorada para apresentar o essencial primeiro e explicar o conteúdo de forma fácil de ler. No entanto, não foi apresentada separadamente uma taxa de melhoria da qualidade dos documentos em coreano. Verifique os seguintes pontos com documentos usados pela sua equipe.

- Se a conclusão está separada das justificativas
- Se o estilo e o formato solicitados são respeitados
- Se os números e as citações podem ser conferidos no original
- Se os motivos das alterações no código são explicados de modo que possam ser revisados

## O significado da redução de 85% na avaliação de segurança

A redução de cerca de 85% se refere às tentativas de contornar os limites de isolamento. A comparação é com o Opus 5 ou o Claude Mythos 5.1. Isso não significa que a taxa de incidentes em serviços reais tenha caído na mesma proporção.

Um sandbox é um ambiente de execução que limita o acesso de um programa. A avaliação de segurança do modelo e as restrições de acesso desse ambiente são coisas distintas. Uma pontuação melhor na avaliação não é motivo para ampliar automaticamente as permissões operacionais.

A Anthropic explica que ainda é difícil detectar todas as falhas nas avaliações antes da implantação. O alcance desse número pode ser conferido na [seção de segurança do anúncio do Claude Opus 5.5](https://www.anthropic.com/claude-opus-5-5). Durante a operação, verifique também o escopo de acesso aos arquivos e os registros de execução.

## Configurações a verificar na migração da API

Em uma integração existente com a API, é preciso verificar também as configurações além do nome do modelo. O identificador do modelo na API Claude é `claude-opus-5-5`. Outros serviços de nuvem usam os identificadores de modelo de suas respectivas plataformas.

A documentação oficial de migração descreve a seguinte mudança na configuração de raciocínio:

> Thinking can't be disabled

A fonte é o documento [Migrating to Claude Opus 5.5](https://platform.claude.com/docs/en/models/opus-5-5/migration-guide), da Anthropic. Isso significa que a configuração para desativar o raciocínio não é aceita.

1. Verifique se as solicitações existentes têm uma configuração que desativa o raciocínio. O Opus 5.5 rejeita essa configuração.
2. Especifique `effort`, que define a intensidade do raciocínio. O valor padrão do Opus 5.5 é `medium`.
3. Verifique as configurações que forçam chamadas de ferramentas específicas. Configurações não aceitas causam erros na solicitação.
4. Processe a resposta distinguindo os blocos pelo campo `type`. O primeiro bloco nem sempre é o texto da resposta.
5. Meça novamente o custo e o tempo de conclusão com a mesma tarefa. Os tokens de raciocínio também estão incluídos na cobrança de saída.

Na época do lançamento, também foi anunciado o suporte na AWS, no Google Cloud e no Microsoft Azure. Os identificadores de modelo e as condições de suporte a ferramentas podem variar conforme a plataforma. Consulte a documentação de migração correspondente ao modelo usado na integração existente.

## Erros comuns

Ao ler os números de preço e desempenho, é preciso distinguir o que foi medido. Preço unitário, custo por tarefa e pontuação em avaliações são indicadores diferentes. A distinção abaixo ajuda a manter as condições da comparação.

| Interpretação equivocada | Significado confirmado |
| --- | --- |
| Todas as cobranças caem 40% | Estimativa para tarefas comuns com as configurações padrão |
| Usar o cache reduz o custo total em 60% | Apenas o preço unitário da leitura do cache caiu 60% |
| O desempenho aumentou 14.1% | A pontuação no Terminal-Bench aumentou 14.1 pontos percentuais |
| Todas as tarefas são concluídas 30% mais rápido | A velocidade de geração da saída aumentou mais de 30% |
| Os incidentes reais caíram 85% | As tentativas de contornar os limites em uma avaliação específica caíram cerca de 85% |

## Comparação do custo por tarefa concluída

Ao escolher um modelo, compare o custo por tarefa aprovada na revisão. O preço por token, sozinho, não mostra o peso das novas tentativas e correções. Essa é uma forma de comparação para aplicar os números anunciados ao trabalho real.

O cálculo consiste em dividir o custo total de execução pelo número de tarefas aprovadas na revisão. Inclua também o custo das tentativas malsucedidas no custo total de execução. Registrar o tempo de revisão humana como um item separado ajuda na comparação.

- Usar a mesma lista de tarefas e os mesmos critérios de conclusão
- Separar os custos de entrada comum, cache e saída
- Registrar o custo total, incluindo falhas e novas tentativas
- Registrar se a tarefa passou pela revisão final
- Distinguir o tempo de execução do tempo de correção humana

## FAQ

### Quando o Claude Opus 5.5 foi lançado?
A Anthropic lançou o Claude Opus 5.5 em 22 de setembro de 2026.

### Qual é o preço padrão da API do Claude Opus 5.5?
No lançamento, os preços eram de US$ 4 por 1 milhão de tokens de entrada e US$ 20 por 1 milhão de tokens de saída. Ambos são 20% menores que os do Opus 5.

### Os custos sempre caem 40%?
Os 40% são uma estimativa calculada pela Anthropic para tarefas comuns. A economia real varia conforme o consumo de tokens e o uso do cache.

### Quanto caiu o preço de leitura do cache?
Caiu de US$ 0,50 para US$ 0,20 por 1 milhão de tokens. A redução no preço de leitura é de 60%. O custo de criação do cache deve ser verificado separadamente.

### Qual é o nome exato da avaliação de uso do computador?
O nome da avaliação no anúncio oficial é OSWorld 2.1. A pontuação do Opus 5.5 é de 81,8% e vem acompanhada da indicação partial.

### O dado de segurança de 85% indica uma redução de incidentes?
Significa que, em uma avaliação específica, as tentativas de contornar os limites de isolamento caíram cerca de 85%. Não se refere a uma redução de incidentes em serviços reais.

### Basta trocar o nome do modelo na API existente?
Dependendo das configurações das requisições existentes, podem ser necessárias outras alterações. Consulte o documento de migração para verificar as configurações de raciocínio, as chamadas obrigatórias de ferramentas e a forma de processar os blocos de resposta.

### Também está disponível na AWS e no Google Cloud?
O anúncio de lançamento incluiu suporte à AWS, ao Google Cloud e ao Microsoft Azure. Verifique o identificador do modelo e as condições de suporte aos recursos em cada plataforma.

### A maior velocidade de geração da saída e a redução do tempo para concluir tarefas são a mesma coisa?
São métricas diferentes. Se, além da geração da saída, houver execução de ferramentas e testes, o tempo total para concluir a tarefa pode variar.

## Sources

- [Anthropic, Apresentando o Claude Opus 5.5, 22 de setembro de 2026](https://www.anthropic.com/claude-opus-5-5)
- [Anthropic, Informações sobre o modelo Claude Opus e seus preços](https://www.anthropic.com/claude/opus)
- [Claude Platform Docs, Migração para o Claude Opus 5.5](https://platform.claude.com/docs/en/models/opus-5-5/migration-guide)
- [Claude Platform Docs, Cache de prompts](https://platform.claude.com/docs/en/build-with-claude/prompt-caching)

## Images

![Engenheiro com um tablet inspeciona um rack de servidores aberto numa sala de servidores](https://injoys.com/rails/active_storage/blobs/proxy/eyJfcmFpbHMiOnsiZGF0YSI6MjM5MjIsInB1ciI6ImJsb2JfaWQifX0=--9ab6a9e985c76b07acd43a43425994585ce87958/ai-15b093c3.webp)
![Um desenvolvedor verifica um tablet diante de uma fileira de celulares conectados em um laboratório de testes.](https://injoys.com/rails/active_storage/blobs/proxy/eyJfcmFpbHMiOnsiZGF0YSI6MjM5MjgsInB1ciI6ImJsb2JfaWQifX0=--677963acf29b560200099cc3de29dd3eebb74a30/ai-8bc52f98.webp)