
Contexto: O modelo, disponível imediatamente em todas as plataformas da Anthropic, custa $ 5 por milhão de tokens de entrada e $ 25 por milhão de tokens de saída, inalterado em relação ao seu antecess...
A Anthropic lançou o Claude Opus 5 na sexta-feira, um modelo que a empresa diz que oferece quase toda a inteligência de seu Claude Fale 5 topo de linha pela metade do custo — um lançamento que sinaliza como a corrida da IA está mudando da capacidade bruta para a economia do uso diário. O modelo, disponível imediatamente em todas as plataformas da Anthropic, custa $ 5 por milhão de tokens de entrada e $ 25 por milhão de tokens de saída, inalterado em relação ao seu antecessor, o Opus 4.
8. Ele se torna o novo modelo padrão do Claude Max, o nível de consumidor premium da Anthropic e o modelo mais forte disponível no Claude Pro. O posicionamento é deliberado. A Anthropic não está afirmando que o Opus 5 é seu modelo mais inteligente — essa distinção ainda pertence ao Fale 5, e os sistemas rivais mantêm uma vantagem em certos domínios.
Em vez disso, a empresa está usando um argumento mais sutil que pode ser mais importante para os compradores corporativos: que o mais econômico importante trabalho de IA acontece em uma faixa intermediária de dificuldade, onde a inteligência de fronteira entregue de forma eficiente e barata supera a inteligência de fronteira entregue de forma dispendiosa.
"Opus 5 como seu impulsionador diário, o modelo para o qual você entrega um trabalho complexo e revisa quando está pronto", disse um porta-voz da Anthropic em entrevista a Venture Beat, descrevendo como a linha da empresa agora se estratifica. "Fale 5 para o seu trabalho mais ambicioso, os projetos autônomos de dias de duração que nada poderia assumir antes...
Soneto 5 para o trabalho que você executa em escala, onde a velocidade e o custo por chamada decidem o que é enviado. Haiku 4.5 para subagentes e respostas instantâneas." Como os resultados do benchmark Claude Opus 5 se comparam ao Fale 5 e aos modelos rivais de IA No papel, os resultados são impressionantes.
A Anthropic diz que o Opus 5 define novas marcas de última geração em avaliações de codificação e trabalho de conhecimento, incluindo Fronteira-Bença e Global-AA. No Fronteira-Bença v0.1, um benchmark de codificação de terminal agentito, o Opus 5 pontua 43,3% — mais do que o dobro dos 18,7% do Opus 4.8 e bem à frente dos 33,7% de Fale 5 — a um custo menor por tarefa, conforme a empresa.
No ARC-AGI 3, uma avaliação da resolução de novos problemas, os relatórios antrópicos do Opus 5 obtiveram três vezes mais pontos do que o próximo melhor modelo. No Oxford 2.0, um benchmark de uso de computadores, a empresa diz que o modelo supera o melhor resultado do Fale 5 em pouco mais de um terço do custo.
Os números vêm com ressalvas honestas notáveis em um setor propenso aos superlativos. A Anthropic reconhece que o Opus 5 permanece por trás do Mitos 5, um modelo concorrente, em tarefas de segurança cibernética e pesquisa de biologia, e um modelo da família Open AI ainda lidera em um benchmark de codificação agentito.
A advertência mais reveladora veio do próprio Antrópico, quando perguntado onde o Opus 5 continua aquém da Fábula 5. A resposta do porta-voz equivaleu a uma admissão sincera sobre o que os benchmarks capturam e não capturam. “As avaliações onde As vitórias do Opus 5 são tarefas limitadas com um resultado específico, que e onde e mais forte.
O que essas avaliações não medem é a duração", disse o porta-voz disse ao Venture Beat. "Uma maneira de dizer: o Opus 5 é a melhor ferramenta para os trabalhos que os benchmarks podem ver, e o Fale 5 é o que você procura quando o trabalho ultrapassa o benchmark." Fale 5, por outro lado, "é para os trabalhos mais longos e autônomos, onde o modelo tem que permanecer coerente em muitas etapas conectadas ao longo de horas ou dias com
Fonte original:
Anthropic launches Claude Opus 5, a cheaper AI model for coding, agents and enterprise workflows
Categorias: Ciência e Tecnologia, IA
Marcador: Notícias
ARNews Notícias. Preenchendo a necessidade de informações confiáveis. Todos os direitos reservados.
Traduzido por AI