AR NEWS 24h

AR News Notícias. Preenchendo a necessidade de informações confiáveis.

Maceió AL - -

Anthropic lançou Claude Opus 5, um modelo de AI para codificação, agentes e fluxos de trabalho corporativos

Resumo: A Anthropic lançou o Claude Opus 5 na sexta-feira, um modelo que a empresa diz que oferece quase toda a inteligência de seu Claude Fale 5 topo de linha pela metade do custo — um lançamento que sinaliza como a corrida da IA está mudando da capacidade...
Anthropic launches Claude Opus 5, a cheaper AI model for coding, agents and enterprise workflows

Contexto: O modelo, disponível imediatamente em todas as plataformas da Anthropic, custa $ 5 por milhão de tokens de entrada e $ 25 por milhão de tokens de saída, inalterado em relação ao seu antecess...

A Anthropic lançou o Claude Opus 5 na sexta-feira, um modelo que a empresa diz que oferece quase toda a inteligência de seu Claude Fale 5 topo de linha pela metade do custo — um lançamento que sinaliza como a corrida da IA está mudando da capacidade bruta para a economia do uso diário. O modelo, disponível imediatamente em todas as plataformas da Anthropic, custa $ 5 por milhão de tokens de entrada e $ 25 por milhão de tokens de saída, inalterado em relação ao seu antecessor, o Opus 4.

8. Ele se torna o novo modelo padrão do Claude Max, o nível de consumidor premium da Anthropic e o modelo mais forte disponível no Claude Pro. O posicionamento é deliberado. A Anthropic não está afirmando que o Opus 5 é seu modelo mais inteligente — essa distinção ainda pertence ao Fale 5, e os sistemas rivais mantêm uma vantagem em certos domínios.

Em vez disso, a empresa está usando um argumento mais sutil que pode ser mais importante para os compradores corporativos: que o mais econômico importante trabalho de IA acontece em uma faixa intermediária de dificuldade, onde a inteligência de fronteira entregue de forma eficiente e barata supera a inteligência de fronteira entregue de forma dispendiosa.

"Opus 5 como seu impulsionador diário, o modelo para o qual você entrega um trabalho complexo e revisa quando está pronto", disse um porta-voz da Anthropic em entrevista a Venture Beat, descrevendo como a linha da empresa agora se estratifica. "Fale 5 para o seu trabalho mais ambicioso, os projetos autônomos de dias de duração que nada poderia assumir antes...

Soneto 5 para o trabalho que você executa em escala, onde a velocidade e o custo por chamada decidem o que é enviado. Haiku 4.5 para subagentes e respostas instantâneas." Como os resultados do benchmark Claude Opus 5 se comparam ao Fale 5 e aos modelos rivais de IA No papel, os resultados são impressionantes.

A Anthropic diz que o Opus 5 define novas marcas de última geração em avaliações de codificação e trabalho de conhecimento, incluindo Fronteira-Bença e Global-AA. No Fronteira-Bença v0.1, um benchmark de codificação de terminal agentito, o Opus 5 pontua 43,3% — mais do que o dobro dos 18,7% do Opus 4.8 e bem à frente dos 33,7% de Fale 5 — a um custo menor por tarefa, conforme a empresa.

No ARC-AGI 3, uma avaliação da resolução de novos problemas, os relatórios antrópicos do Opus 5 obtiveram três vezes mais pontos do que o próximo melhor modelo. No Oxford 2.0, um benchmark de uso de computadores, a empresa diz que o modelo supera o melhor resultado do Fale 5 em pouco mais de um terço do custo.

Os números vêm com ressalvas honestas notáveis em um setor propenso aos superlativos. A Anthropic reconhece que o Opus 5 permanece por trás do Mitos 5, um modelo concorrente, em tarefas de segurança cibernética e pesquisa de biologia, e um modelo da família Open AI ainda lidera em um benchmark de codificação agentito.

A advertência mais reveladora veio do próprio Antrópico, quando perguntado onde o Opus 5 continua aquém da Fábula 5. A resposta do porta-voz equivaleu a uma admissão sincera sobre o que os benchmarks capturam e não capturam. “As avaliações onde As vitórias do Opus 5 são tarefas limitadas com um resultado específico, que e onde e mais forte.

O que essas avaliações não medem é a duração", disse o porta-voz disse ao Venture Beat. "Uma maneira de dizer: o Opus 5 é a melhor ferramenta para os trabalhos que os benchmarks podem ver, e o Fale 5 é o que você procura quando o trabalho ultrapassa o benchmark." Fale 5, por outro lado, "é para os trabalhos mais longos e autônomos, onde o modelo tem que permanecer coerente em muitas etapas conectadas ao longo de horas ou dias com


Fonte original:
Anthropic launches Claude Opus 5, a cheaper AI model for coding, agents and enterprise workflows

Categorias: Ciência e Tecnologia, IA

Marcador: Notícias

ARNews Notícias. Preenchendo a necessidade de informações confiáveis. Todos os direitos reservados.

Traduzido por AI

Adicionar como fonte preferida
AR NEWS 24H
Adicionar

Postar um comentário

0Comentários
* Por favor, não faça spam aqui. Todos os comentários são revisados ​​pelo administrador.

Busque no AR NEWS 24H