Anthropic desenvolve modelo superior ao Mythos, mas restringe seu uso global
Modelo de IA da Anthropic promete avanços significativos, mas permanece fora do alcance público.
A Anthropic desenvolveu um novo modelo de inteligência artificial, conhecido como Modelo 2, que promete ser ainda mais potente que seu antecessor, o Mythos 5. Este modelo, embora não disponível para testes públicos, é descrito como uma evolução significativa nas capacidades da empresa em diversas tarefas internas.
Segundo a Anthropic, tanto o Mythos 5 quanto o Modelo 2 são amplamente utilizados em áreas como engenharia de software, programação e geração de dados. O relatório interno da empresa indica que o modelo Claude já é responsável por uma parte substancial do código que é integrado aos repositórios de produção. Apesar de sua eficácia, o Modelo 2 ainda não será lançado ao público, pois seus criadores consideram que ele é muito poderoso para essa exposição.
A avaliação do risco associado ao Modelo 2 é considerada baixa, conforme a Anthropic. Durante as avaliações internas, não foram identificados problemas significativos de alinhamento em comparação ao Mythos 5. No entanto, a empresa observou um aumento na percepção de risco de “desalinhamento” em situações críticas, refletindo a preocupação com questões de segurança cibernética que surgiram recentemente no setor.
A Anthropic também admite que sua confiança na avaliação de riscos desses novos modelos diminuiu. Isso se deve ao fato de que as métricas tradicionais de avaliação estão se tornando obsoletas, uma vez que os modelos evoluíram de maneira significativa. No caso do Modelo 2, a empresa não realizou todos os testes habituais, pois não planeja disponibilizá-lo publicamente.
Um ponto interessante levantado pela Anthropic é que seus modelos estão acelerando o progresso na pesquisa e no desenvolvimento de produtos, não apenas em software, mas também em áreas como robótica, biotecnologia e energia. Embora a empresa não acredite que os modelos possam substituir seus pesquisadores, a tendência de automação e aprimoramento contínuo levanta questões sobre o futuro do desenvolvimento tecnológico.
Similarmente, a OpenAI enfrenta dilemas semelhantes com seu modelo de próxima geração, Astra, que está sendo adiado devido a preocupações sobre suas capacidades em cibersegurança. As startups de IA agora se encontram em uma fase de avaliação cuidadosa antes do lançamento de novos modelos, uma mudança em relação à prática anterior de disponibilizar novos desenvolvimentos sem hesitação.
Apesar de a Anthropic continuar avançando no desenvolvimento de modelos mais sofisticados, as recentes notícias indicam um paradoxo no setor. Mesmo com a avaliação de risco sendo considerada baixa, as empresas estão se tornando mais cautelosas quanto ao lançamento de novos modelos, enfatizando a necessidade de garantir que esses sistemas não ultrapassem seus limites antes de serem disponibilizados.
