
O novo lançamento Fable da Anthropic é mais barato, menos restritivo
Na terça-feira, a Anthropic lançou o Fable e o Mythos 5.1, versões gêmeas do modelo de IA mais avançado da empresa. Além de melhorias de desempenho, o novo lançamento do Fable inclui alterações destinadas a reduzir o custo de tokens e restrições de falsos positivos geradas pelas salvaguardas do modelo.
Assim como o modelo Mythos anterior, o Mythos 5.1 estará disponível apenas para parceiros registrados da Anthropic envolvidos em pesquisas de segurança cibernética ou ciências da vida. O Fable 5.1, a versão sem restrições, está disponível a partir de hoje em plataformas de nuvem ou por meio da API da Anthropic.
Uma das mudanças mais significativas é a adoção, noticiada anteriormente pela Anthropic, da política de zero retenção de dados, permitindo que os clientes executem os modelos da Anthropic em sua própria infraestrutura sem vazamento de dados. Anteriormente indisponível para o Fable devido a preocupações de segurança, um serviço de alta privacidade (chamado Enterprise Frontier Safeguards) será lançado para os usuários no outono. Notavelmente, o sistema ainda monitorará o uso indevido por agentes ou usuários humanos, mas os clientes controlarão como esse monitoramento ocorrerá.
Como parte do anúncio, a Anthropic garantiu aos clientes que seus dados não foram acessados indevidamente. “A Anthropic nunca treinou com dados corporativos sem permissão explícita, e nunca o fará”, diz o anúncio.
Como é comum em lançamentos da Anthropic, os novos modelos estabeleceram recordes em uma série de benchmarks, incluindo o Terminal-Bench 4.0 (para programação baseada em linha de comando) e o Humanity’s Last Exam (para raciocínio geral). A Anthropic também divulgou três novas descobertas científicas geradas pelos modelos antes de seu lançamento, incluindo uma otimização personalizada de GPU e um mapa de alta resolução de Vênus montado a partir de fotos existentes.
Assim como em lançamentos anteriores, os modelos vêm acompanhados de uma ficha técnica de sistema detalhada, que explica suas capacidades de maneira bem direta. A ficha técnica classifica o Mythos como de “baixo risco” em relação a preocupações associadas ao desenvolvimento automatizado de IA — cenário em que a IA aprimora a si mesma —, o qual alguns enxergam como um gatilho para a perda de controle humano. O documento afirma que “sua capacidade de acelerar o progresso interno de P&D em IA está alinhada às tendências atuais”.
Em termos de comportamento inadequado geral, o Mythos é um pouco mais propenso a isso do que o Opus, possivelmente como resultado de suas capacidades aprimoradas.
“O Mythos 5.1 apresenta uma leve regressão em termos de comportamento desalinhado geral em comparação com o Opus 5, e uma melhoria em relação ao Mythos 5 e ao Claude Sonnet 5”, diz a ficha técnica do sistema. “Ele coopera com o uso indevido por humanos e aceita alegações de autorização inverificáveis com um pouco mais de facilidade do que o Opus 5, mas tem menos probabilidade de ignorar restrições explícitas, alucinar entradas ou afirmar falsamente que concluiu tarefas do que os modelos anteriores.”