Ir para o conteúdo

Claude Fable 5.1 e Mythos 5.1: O que são e como revolucionam a IA para empresas

Claude Fable 5.1 e Mythos 5.1: O que são e como revolucionam a IA para empresas

Key takeaways

  • Claude Fable 5.1 e Mythos 5.1 são os modelos mais avançados da Anthropic para codificação, trabalho intelectual e pesquisa científica.
  • Fable 5.1 oferece redução de custos de até 45% em workloads típicos, graças a melhorias na leitura de cache.
  • Mythos 5.1 é uma versão com salvaguardas reforçadas para cibersegurança e ciências biológicas, com acesso restrito.
  • Ambos os modelos apresentam desempenho superior em benchmarks de codificação, resolução de problemas e raciocínio multidisciplinar.
  • A Anthropic introduziu o sistema Enterprise Frontier Safeguards (EFS) para garantir privacidade total dos dados dos clientes.
  • Os modelos estão em conformidade com o EU AI Act, atendendo a regulamentações rigorosas de IA.

O que são Claude Fable 5.1 e Claude Mythos 5.1?

A Anthropic, empresa líder em segurança e pesquisa em IA, lançou recentemente dois modelos avançados: Claude Fable 5.1 e Claude Mythos 5.1. Esses modelos representam um marco na evolução da inteligência artificial, especialmente para empresas que dependem de codificação, trabalho intelectual e pesquisa científica.

Embora compartilhem a mesma base tecnológica, os dois modelos diferem em níveis de salvaguardas. O Fable 5.1 é de uso geral e está disponível para todos os clientes, enquanto o Mythos 5.1 é restrito a programas de acesso confiável, com salvaguardas específicas para áreas como cibersegurança e ciências biológicas.

Desempenho e eficiência: O que mudou?

Um novo padrão em codificação e resolução de problemas

O Claude Fable 5.1 estabelece um novo padrão de desempenho em tarefas complexas, como codificação, resolução de problemas de longo prazo e raciocínio multidisciplinar. Segundo benchmarks internos, o Fable 5.1 supera seu antecessor, o Fable 5, em diversas métricas:

  • Terminal-Bench-Science 0.1: 52,6% (Fable 5.1) vs. 24,7% (Fable 5).
  • Terminal-Bench 4.0 (codificação agentiva): 55,8% (Fable 5.1) vs. 42,0% (Fable 5).
  • Humanity’s Last Exam (raciocínio multidisciplinar): 65,0% com ferramentas (Fable 5.1) vs. 63,6% (Fable 5).

Além disso, o Fable 5.1 evita "atalhos" que comprometem a qualidade do trabalho, corrigindo causas raízes de problemas de software. Em um caso real, o modelo identificou a causa de uma falha rara em sistemas internos de uma empresa de investimentos, algo que engenheiros humanos e outros modelos não conseguiram resolver após anos de tentativas.

Redução de custos e eficiência operacional

A Anthropic anunciou uma redução de custos significativa para o Fable 5.1. Em workloads típicos, o modelo custa cerca de 25% menos que o Fable 5, graças a melhorias na leitura de cache. Para tarefas altamente agentivas, a economia pode chegar a 45%, tornando-o uma opção mais acessível para empresas que buscam automação avançada.

Segurança e privacidade: Prioridades da Anthropic

Salvaguardas aprimoradas

Uma das principais melhorias do Fable 5.1 é a redução de falsos positivos nas salvaguardas. Em cibersegurança, por exemplo, o novo modelo bloqueia 60% menos falsos positivos em comparação com versões anteriores. Isso é possível porque o Fable 5.1 agora pode ser usado para descobrir vulnerabilidades de software, embora não seja permitido desenvolver exploits para elas.

Para o Mythos 5.1, a Anthropic estabeleceu um programa de acesso em parceria com o governo dos EUA, focado em ciências biológicas. O objetivo é garantir que o modelo seja utilizado de forma ética e segura em pesquisas avançadas.

Privacidade total com Enterprise Frontier Safeguards (EFS)

A Anthropic introduziu o Enterprise Frontier Safeguards (EFS), um sistema que permite aos clientes armazenar dados em infraestrutura própria, garantindo privacidade total. Embora o EFS ainda esteja em fase de implementação gradual, clientes elegíveis já podem utilizar o Fable 5.1 com política de zero retenção de dados.

Aplicações práticas: Como empresas estão usando

Empresas de diversos setores já estão aproveitando os benefícios do Fable 5.1. Veja alguns exemplos:

  • Jane Street Capital: O modelo resolveu mais problemas de codificação do que versões anteriores e alcançou resultados de ponta em "trading intuition".
  • Cognition: A empresa migrou seu tráfego do Opus 5 para o Fable 5.1, destacando a redução de custos e a eficiência em tarefas como revisão de código.
  • Millennium: O Fable 5.1 identificou a causa de uma falha rara em sistemas internos, algo que nenhum engenheiro ou modelo anterior conseguiu fazer.
  • MongoDB: O modelo construiu um protótipo complexo em três dias, realizando pesquisas em documentação e implementando soluções de forma autônoma.

Conformidade regulatória e acesso

Alinhamento com o EU AI Act

A Anthropic confirmou que tanto o Fable 5.1 quanto o Mythos 5.1 estão em conformidade com o EU AI Act, regulamentação europeia que estabelece diretrizes rigorosas para o desenvolvimento e uso de IA. Isso garante que as empresas possam utilizar os modelos sem preocupações legais.

Disponibilidade e custos

O Claude Fable 5.1 já está disponível para todos os clientes, enquanto o Mythos 5.1 é acessível apenas por meio de programas de confiança da Anthropic. A empresa planeja abrir inscrições para cientistas interessados em utilizar o Mythos 5.1 em pesquisas avançadas.

FAQ

O que são Claude Fable 5.1 e Claude Mythos 5.1?

São modelos avançados de IA desenvolvidos pela Anthropic, otimizados para codificação, trabalho intelectual e pesquisa científica. Fable 5.1 é de uso geral, enquanto Mythos 5.1 possui salvaguardas específicas para cibersegurança e ciências biológicas.

Quais são as principais melhorias do Claude Fable 5.1?

O Fable 5.1 oferece desempenho superior em tarefas de codificação e resolução de problemas, redução de 25% a 45% nos custos, melhorias nas salvaguardas para reduzir falsos positivos e maior privacidade com o sistema Enterprise Frontier Safeguards (EFS).

Como o Claude Mythos 5.1 é diferente do Fable 5.1?

O Mythos 5.1 é uma versão do Fable 5.1 com salvaguardas reforçadas, projetadas para suportar trabalhos em cibersegurança e ciências biológicas. Seu acesso é restrito a programas de confiança da Anthropic.

Quais setores podem se beneficiar desses modelos?

Empresas de desenvolvimento de software, instituições de pesquisa científica, equipes de cibersegurança e organizações que necessitam de soluções avançadas para automação de workflows e análise de dados complexos.

Como a Anthropic garante a segurança e privacidade dos dados?

A Anthropic implementou o sistema Enterprise Frontier Safeguards (EFS), que permite armazenar dados em infraestrutura controlada pelo cliente, garantindo privacidade total. Além disso, os modelos possuem salvaguardas para evitar usos adversariais.

Os modelos Claude Fable 5.1 e Mythos 5.1 estão em conformidade com regulamentações como o EU AI Act?

Sim, a Anthropic afirma que ambos os modelos estão em conformidade com o EU AI Act, garantindo que seu uso esteja alinhado com as regulamentações europeias de IA.

À lire aussi

Modifier l'article

Image actuelle : Image actuelle

Paisible AI