IA

Anthropic divide Claude em dois: Mythos para poucos, Fable para o resto

A empresa lança Claude Mythos 5 só para parceiros “de confiança” e Claude Fable 5 para o público, com bloqueios agressivos em cibersegurança, biologia e química. Meio modelo novo, meio travão.

Anthropic divide Claude em dois: Mythos para poucos, Fable para o resto

A Anthropic decidiu que a próxima geração do Claude vem em dose dupla. Claude Mythos 5, o modelo com capacidades mais agressivas em cibersegurança, fica reservado a um clube fechado de parceiros industriais e investigadores. Para o resto do mundo há Claude Fable 5, supostamente com o mesmo cérebro, mas com uma mordaça bem apertada.

Depois do Mythos Preview em abril, que já vinha limitado e entregue apenas a empresas tecnológicas no âmbito do consórcio Project Glasswing, a Anthropic continua a tratar estes modelos como material perigoso. A preocupação é clara: Mythos consegue encontrar vulnerabilidades em software novo e legado e ajudar a montar ferramentas de ataque. A empresa está a trabalhar com o governo dos EUA no rollout, o que dá logo a medida do tipo de risco que querem transmitir, mas também do controlo político que aceitam na estratégia.

Claude Fable 5 é a peça pública do puzzle. Usa o mesmo modelo subjacente que o Mythos 5, mas arranca com guardrails a sério em cibersegurança, biologia e química. Perguntas nestas áreas passam a ser filtradas e, se caírem na zona vermelha dos classificadores da Anthropic, são automaticamente desviadas para um modelo antigo, Claude Opus 4.8. O mesmo acontece se a empresa suspeitar que alguém está a fazer distillation, ou seja, a tentar treinar um modelo mais pequeno a partir das respostas do Fable.

Diane Penn, responsável de gestão de produto na Anthropic, admite que o sistema foi desenhado para errar por excesso de cautela. Ou seja, muitas questões legítimas de segurança ou investigação podem ir parar ao Opus 4.8 só porque o filtro é nervoso. A promessa é que, com o tempo, os classificadores fiquem mais finos. Mas para já isto significa que “Fable 5” não é bem um modelo, é um portal que decide se tens acesso ao novo cérebro ou a um mais antigo. O marketing fala em novo modelo, a arquitetura real parece mais um sistema de comutação com muito medo de ser processado ou acusado de negligência.

Enquanto isso, Mythos 5 fica para quem a Anthropic considera confiável: parceiros de Project Glasswing e um grupo restrito de investigadores em biologia. A empresa admite que está a fornecer versões sem restrições a estes clientes até existir um programa de “acesso de confiança” mais formal. Traduzido: querem ganhar tempo para montar uma estrutura de gatekeeping antes de estes modelos serem inevitavelmente igualados por concorrentes privados e, mais cedo ou mais tarde, por modelos com pesos abertos.

Há também o lado prosaico do negócio. Claude Fable 5 e Mythos 5 custam 10$ por milhão de tokens de input e 50$ por milhão de tokens de output, cerca do dobro dos modelos públicos atuais da Anthropic, mas menos que o Mythos Preview. A empresa cobra mais por capacidades que diz não conseguir disponibilizar em segurança a toda a gente. O resultado é um estranho equilíbrio: quem paga e entra no clube ganha uma máquina de hacking assistido para reforçar as suas defesas, quem fica de fora recebe uma versão domesticada que finge não saber demasiado. Para utilizadores na Europa, Portugal incluído, isto é mais um lembrete de que a conversa sobre “IA segura” está a ser decidida entre poucas empresas e governos, e só depois adaptada a quem quer apenas uma ferramenta de trabalho mais capaz.

Fonte: Wired

Comentários · 0