mythos

Auto Added by WPeMatico

destaque anthropic claude mythos 1024x576

Anthropic lança Claude Fable 5.1 com mais desempenho, menor custo e menos restrições

A Anthropic lançou nesta terça-feira (1) o Claude Fable 5.1 e o Claude Mythos 5.1, novas versões de sua família mais avançada de modelos de inteligência artificial (IA). A atualização combina melhorias de desempenho com mudanças que reduzem o custo de uso e a quantidade de bloqueios provocados pelos mecanismos de segurança do Fable.

O Fable 5.1 é a versão destinada ao público e está disponível pela API da Anthropic e por plataformas de computação em nuvem. Já o Mythos 5.1, que utiliza o mesmo modelo subjacente, continua restrito a parceiros selecionados da Anthropic envolvidos em pesquisas de cibersegurança e ciências da vida.

A empresa afirma que os novos modelos representam nova fronteira de desempenho em programação e tarefas de conhecimento. Nos testes divulgados pela Anthropic, o Fable 5.1 alcançou 52,6% no Terminal-Bench-Science 0.1, voltado a pesquisas científicas realizadas por agentes de IA, contra 24,7% do Fable 5.

No Terminal-Bench 4.0, voltado à programação por meio de terminal, o Fable 5.1 chegou a 55,8%, ante 42% do Fable 5. O Mythos 5.1 alcançou 60,9% nesse mesmo teste.

O novo modelo também obteve 77,9% no OSWorld 2.0 em sua modalidade parcial e 41,7% no teste considerado mais rigoroso. No Humanity’s Last Exam, o Fable 5.1 atingiu 60,9% sem ferramentas e 65% com ferramentas.

Modelo fica mais barato

  • Apesar dos ganhos de desempenho, a Anthropic manteve os preços básicos do Fable 5.1 em US$ 10 por milhão de tokens de entrada (R$ 51,87) e US$ 50 por milhão de tokens de saída (R$ 259,35);
  • A redução de custo ocorre principalmente no armazenamento em cache. A leitura de tokens armazenados em cache ficou 75% mais barata, o que pode diminuir o custo efetivo de determinadas cargas de trabalho;
  • A mudança é especialmente relevante para tarefas longas e agentes de IA, que precisam reutilizar grandes quantidades de contexto durante várias etapas de uma operação;
  • A própria Anthropic destaca que o Fable 5.1 foi desenvolvido para trabalhos que exigem períodos mais longos de execução, incluindo programação, pesquisa científica, produção de documentos e outras atividades complexas.

Leia mais:

Mythos 5.1, que utiliza o mesmo modelo subjacente, continua restrito a parceiros selecionados da Anthropic envolvidos em pesquisas de cibersegurança e ciências da vida – Imagem: gguy/Shutterstock

Menos bloqueios durante o uso

Outra mudança importante está nos mecanismos de segurança. O Fable 5 foi criticado por bloquear solicitações legítimas quando seus sistemas identificavam possíveis relações com áreas consideradas de alto risco, especialmente cibersegurança.

Com o Fable 5.1, a Anthropic afirma ter aprimorado essas proteções para reduzir os chamados falsos positivos. A empresa explica que o Fable 5.1 e o Mythos 5.1 são essencialmente o mesmo modelo, e que parte da diferença observada nos testes anteriores estava relacionada à intervenção dos mecanismos de segurança.

Segundo a Anthropic, quando essas proteções interferem em determinados testes, as tarefas de cibersegurança são encaminhadas para o Claude Opus 4.8 e as relacionadas à biologia, para o Claude Opus 5. Isso pode reduzir o desempenho registrado pelo Fable em algumas avaliações.

A nova versão também representa uma mudança importante na política de privacidade. A Anthropic passou a oferecer Zero Data Retention, permitindo que clientes utilizem os modelos em sua própria infraestrutura sem que os dados deixem esses ambientes.

O sistema continuará monitorando possíveis abusos por agentes ou usuários humanos, mas os clientes terão maior controle sobre a forma como esse monitoramento será realizado. A Anthropic também afirma que nunca treinou seus modelos com dados empresariais sem autorização explícita e que não pretende fazê-lo.

Resultados em tarefas reais

Além dos benchmarks, a Anthropic divulgou resultados obtidos por empresas que tiveram acesso antecipado ao Fable 5.1.

A empresa de investimentos Millennium, por exemplo, afirma que o modelo identificou a causa de uma falha extremamente rara em seus sistemas internos que engenheiros não haviam conseguido explicar durante anos. O modelo analisou uma biblioteca externa, comparou o código com um core dump e identificou um problema na biblioteca como origem da falha.

A MongoDB relatou que o Fable 5.1 foi capaz de pesquisar o código e a documentação de seus serviços, desenvolver um protótipo complexo e trabalhar durante horas sem supervisão, utilizando ciclos de verificação para avaliar o próprio trabalho.

A Anthropic também afirma que os modelos produziram resultados científicos antes do lançamento, incluindo uma otimização personalizada de GPU e um mapa de alta resolução de Vênus construído a partir de fotografias existentes.

Apesar dos avanços, a própria documentação de segurança da Anthropic aponta que o Mythos 5.1 apresenta uma pequena piora em relação ao Opus 5 em determinados comportamentos de desalinhamento.

Segundo o documento, o modelo aceita com um pouco mais de facilidade solicitações relacionadas a usos indevidos e alegações de autorização que não podem ser verificadas, embora seja menos propenso a ignorar restrições explícitas, inventar entradas ou afirmar falsamente que concluiu uma tarefa em comparação com modelos anteriores.

O post Anthropic lança Claude Fable 5.1 com mais desempenho, menor custo e menos restrições apareceu primeiro em Olhar Digital.

Anthropic lança Claude Fable 5.1 com mais desempenho, menor custo e menos restrições Read More »

shutterstock 2428082879 1024x682

ByteDance prepara modelo de IA com escala que pode superar o Mythos da Anthropic

A ByteDance está treinando um novo modelo de inteligência artificial que pode alcançar a marca de 10 trilhões de parâmetros, aproximando sua escala da tecnologia mais avançada atribuída à Anthropic, segundo informações exclusivas do Financial Times.

O desenvolvimento ocorre na China, em meio à aceleração da corrida global por sistemas de IA mais poderosos. Caso confirmado, o modelo da empresa dona do TikTok superaria em mais de três vezes a dimensão anunciada para o Kimi K3, da startup chinesa Moonshot AI, que possui 2,8 trilhões de parâmetros.

A iniciativa faz parte da estratégia de empresas chinesas de ampliar sua competitividade diante de concorrentes dos Estados Unidos, buscando criar modelos maiores sem tornar sua operação excessivamente cara.

Novo sistema ainda está em fase inicial de treinamento

(Imagem: RidhamSupriyanto / Shutterstock.com)

A ByteDance iniciou a etapa de pré-treinamento do modelo, processo que costuma levar entre três e seis meses antes das fases posteriores de ajuste e eventual lançamento ao público.

O número de parâmetros é usado como uma referência para medir a escala de um modelo de inteligência artificial. Esses elementos representam configurações matemáticas aprendidas pelo sistema a partir de dados e ajudam a tecnologia a identificar padrões, produzir respostas e executar tarefas, embora a quantidade de parâmetros, por si só, não determine a capacidade total de uma ferramenta.

Logo da Anthropic em uma parede com pessoas ao redor
Anthropic – Imagem: PhotoGranary02/Shutterstock

O avanço da companhia ocorre após uma sequência de investimentos de empresas chinesas no desenvolvimento de grandes modelos de IA. Antes do lançamento do Kimi K3, modelos como LongCat-2.0, da Meituan, e DeepSeek V4-Pro estavam entre os maiores da indústria chinesa, ambos com 1,6 trilhão de parâmetros.

Comparações diretas entre modelos chineses e norte-americanos permanecem limitadas porque empresas como Anthropic e OpenAI não divulgam a quantidade de parâmetros de sistemas como Mythos, Fable ou GPT-5.5.

Estimativas do setor citadas pelo Financial Times apontam que o Mythos 5, da Anthropic, teria aproximadamente 8 trilhões de parâmetros, enquanto o Fable 5 teria cerca de 5 trilhões. Nesse cenário, o projeto da ByteDance estaria próximo da escala atribuída ao sistema mais avançado da companhia americana.

O post ByteDance prepara modelo de IA com escala que pode superar o Mythos da Anthropic apareceu primeiro em Olhar Digital.

ByteDance prepara modelo de IA com escala que pode superar o Mythos da Anthropic Read More »

anthropic 1 1024x585 4

Anthropic: Mythos encontra vulnerabilidades em algoritmos de criptografia

O Claude Mythos Preview, modelo de inteligência artificial (IA) desenvolvido pela Anthropic, conseguiu identificar novas formas de explorar vulnerabilidades em uma versão simplificada de um dos algoritmos de criptografia mais utilizados no mundo, o Advanced Encryption Standard (AES).

A descoberta, anunciada pela empresa nesta terça-feira (28), reforça as preocupações sobre os impactos que modelos de IA cada vez mais avançados podem ter na segurança cibernética global.

Segundo os pesquisadores da Anthropic, o modelo foi capaz de descobrir métodos inéditos para atacar algoritmos criptográficos responsáveis por proteger desde transações bancárias online e comunicações privadas até informações sigilosas de governos contra hackers e outros agentes mal-intencionados.

O estudo indica que a IA pode, no futuro, desafiar princípios fundamentais sobre os quais a internet foi construída. Embora especialistas já esperem que a IA transforme diversos setores, os avanços têm sido especialmente rápidos nas áreas de programação e segurança digital.

Apesar da relevância da descoberta, a Anthropic ressalta que não há risco imediato para os sistemas atualmente em uso. As vulnerabilidades encontradas dizem respeito apenas a uma versão enfraquecida do AES, utilizada em pesquisas para avaliar a resistência de algoritmos criptográficos.

AES e testes de confiabilidade

  • O AES é um protocolo amplamente empregado para proteger o tráfego da internet, redes sem fio, sistemas de armazenamento de dados e diversos outros serviços digitais;
  • Testar versões simplificadas desses algoritmos é uma prática comum entre pesquisadores para entender se computadores mais poderosos poderão, no futuro, quebrar os padrões reais de criptografia;
  • A lógica é semelhante à de resolver um problema matemático mais simples para identificar padrões que possam ser aplicados a desafios muito mais complexos.

Durante os testes, o Claude Mythos Preview conseguiu romper essa versão reduzida do AES utilizando um método que, segundo a Anthropic, tornou o ataque entre 200 e mil vezes mais rápido do que as melhores técnicas desenvolvidas anteriormente por pesquisadores humanos.

Embora as consequências imediatas sejam limitadas, os pesquisadores afirmam que as implicações de longo prazo podem ser significativas.

Em testes anteriores, modelos de linguagem de grande porte não conseguiam igualar o desempenho de especialistas humanos em pesquisas criptográficas, um campo altamente dependente de matemática avançada.

A rápida evolução dessas ferramentas, no entanto, sugere um cenário em que futuros modelos poderão superar proteções de segurança consideradas essenciais para praticamente toda a infraestrutura da internet.

Nicholas Carlini, cientista de pesquisa da Anthropic que participou dos testes de criptografia e anteriormente trabalhou na divisão de IA do Google, afirmou que a evolução dos modelos foi muito mais rápida do que esperava.

“Eles não conseguiam resolver problemas que eu conseguia quando tinha 16 anos”, disse Carlini em entrevista ao The New York Times. “Agora eles estão realizando pesquisas de ponta que nunca haviam sido descobertas na área.”

Os avanços recentes dos chamados modelos de fronteira também vêm despertando preocupação entre governos de diversos países, incluindo o governo do presidente Donald Trump, principalmente devido às capacidades relacionadas à segurança cibernética.

Quando o Claude Mythos foi apresentado, em abril, demonstrou tanta eficiência para encontrar e explorar falhas em softwares que a Anthropic decidiu restringir seu acesso a órgãos governamentais e organizações selecionadas, buscando reduzir o risco de uma possível catástrofe digital em escala global.

Leia mais:

Mythos é da Anthropic – Imagem: PhotoGranary02/Shutterstock

Embora o governo Trump tenha adotado inicialmente uma postura de pouca intervenção na regulamentação da IA, a administração passou a adotar um modelo de supervisão mais flexível. Atualmente, diversas empresas estadunidenses submetem seus modelos ao governo antes do lançamento público. O Mythos continua indisponível para o público em geral.

As preocupações aumentaram novamente na semana passada, quando a OpenAI revelou que alguns de seus modelos conseguiram escapar de um ambiente de testes isolado, conhecido como sandbox, criado justamente para impedir acesso à internet. Segundo a empresa, os sistemas invadiram uma biblioteca digital de IA na tentativa de obter respostas para um exame que avaliava suas capacidades.

Autoridades de inteligência dos Estados Unidos e de países ocidentais alertam há décadas que uma eventual quebra dos atuais padrões de criptografia teria consequências profundas para a privacidade digital e para a segurança nacional.

Há suspeitas, por exemplo, de que a China tenha armazenado grandes volumes de dados criptografados com a expectativa de conseguir decifrá-los futuramente. Ao mesmo tempo, a disputa tecnológica entre Estados Unidos e China pelo desenvolvimento de computadores quânticos capazes de romper os protocolos modernos de criptografia aumentou ainda mais essas preocupações.

Além da descoberta envolvendo o AES, o Claude Mythos também desenvolveu uma técnica aprimorada de ataque contra outro sistema criptográfico chamado HAWK, projetado para resistir tanto a computadores convencionais quanto a futuros computadores quânticos.

Embora o HAWK ainda não esteja em uso, ele está sendo avaliado pelo Instituto Nacional de Padrões e Tecnologia dos Estados Unidos (NIST, na sigla em inglês) como um possível novo padrão criptográfico.

Segundo a Anthropic, os próprios autores do HAWK validaram o ataque desenvolvido pela IA, enquanto criptógrafos independentes revisaram a descoberta relacionada ao AES. A empresa informou ainda que compartilhou os resultados com o governo estadunidense e parceiros da indústria antes da publicação do estudo.

A Anthropic afirma que o Claude Mythos elaborou praticamente de forma autônoma o novo ataque contra o AES. Inicialmente, porém, o modelo recusou-se a analisar o problema por acreditar que seria impossível superar os métodos existentes.

Após receber novos incentivos dos pesquisadores, permaneceu cerca de uma semana trabalhando na questão até desenvolver a técnica inédita. Em seguida, dois pesquisadores humanos passaram quase um mês verificando se o método estava correto.

A criptografia é considerada um dos pilares da internet moderna, protegendo praticamente todas as atividades realizadas no ambiente digital. Algumas das técnicas ainda utilizadas atualmente guardam segredos do mundo desde a década de 1970. Já a criptografia quântica, baseada em propriedades da física quântica, é considerada teoricamente impossível de ser quebrada.

Adotado como padrão oficial do governo dos Estados Unidos em 2001, o AES era amplamente visto como praticamente inviolável. Os métodos tradicionais de força bruta, nos quais computadores tentam adivinhar combinações de senhas ou chaves de criptografia por tentativa e erro, são considerados incapazes de derrotar o algoritmo. Estima-se que o AES possua um número de combinações de chaves comparável ao número de átomos existentes no universo observável.

Mesmo assim, o avanço acelerado da IA tem superado expectativas que muitos especialistas julgavam inalcançáveis poucos anos atrás. Esse progresso alimenta preocupações de que, no futuro, os fundamentos matemáticos que sustentam os atuais padrões de segurança da internet possam se tornar vulneráveis mesmo antes de os computadores quânticos se tornarem realidade.

“Dado que estamos constantemente subestimando o poder e o tempo necessário para que futuros modelos estejam disponíveis, será que realmente estamos confortáveis em acreditar que, daqui a dois anos, a criptografia forte não estará ameaçada?”, questionou Glenn S. Gerstell, ex-conselheiro-geral da Agência de Segurança Nacional dos Estados Unidos (NSA, na sigla em inglês).

“Os matemáticos diriam que, com o poder computacional atual, não deveria ser possível quebrar uma criptografia forte em um tempo relevante”, acrescentou Gerstell, que ajudou a elaborar um relatório sobre criptologia em 2022.

“Mas não acho que as capacidades dos modelos futuros no médio prazo — antes da computação quântica ou da criptografia resistente à computação quântica — devam ser descartadas como algo trivial nesse contexto.”

O post Anthropic: Mythos encontra vulnerabilidades em algoritmos de criptografia apareceu primeiro em Olhar Digital.

Anthropic: Mythos encontra vulnerabilidades em algoritmos de criptografia Read More »

google gemini logo 202604120221 1024x576

Google atualiza Gemini, lança concorrente do Mythos e apimenta corrida das IAs

O Google apresentou três novos modelos de inteligência artificial para acelerar a disputa com OpenAI e Anthropic. As novidades incluem versões mais rápidas, econômicas e especializadas em segurança digital.

Os lançamentos reforçam a estratégia da empresa para ampliar sua presença na corrida da IA, com foco em agentes inteligentes, programação e proteção contra ataques cibernéticos.

A nova geração de IA do Google aposta em velocidade, economia e recursos para agentes inteligentes em diferentes tarefas. – Imagem criada por inteligência artificial (ChatGPT / Olhar Digital)

Gemini ganha versões mais rápidas e especializadas

O destaque é o Gemini 3.6 Flash, descrito pelo Google como o modelo Flash mais avançado da empresa. Ele promete melhor desempenho em programação, tarefas de conhecimento e recursos multimodais, consumindo 17% menos tokens do que a versão anterior e reduzindo os custos de uso.

Ao lado dele chegam o Gemini 3.5 Flash Cyber, ajustado para identificar e corrigir vulnerabilidades em softwares, e o Gemini 3.5 Flash-Lite, criado para tarefas de alto volume e agentes de IA que executam ações de forma autônoma.

“Os novos modelos Flash foram desenvolvidos para atingir o ponto ideal entre eficiência e qualidade”, afirmou Tulsee Doshi, diretora sênior de gerenciamento de produtos da equipe Gemini.

Logos de Anthropic e OpenAI
A estratégia do Google reforça a disputa direta com OpenAI, Anthropic e outras empresas que lideram a corrida da IA. – Imagem: Thrive Studios ID/Shutterstock

Segurança e eficiência entram no centro da disputa

Além de aumentar o desempenho, o Google aposta na segurança como um dos diferenciais da nova geração de modelos. A empresa afirma que o Gemini 3.6 Flash recebeu reforços para resistir melhor a tentativas de uso indevido em ataques cibernéticos, sem comprometer aplicações legítimas.

Entre os principais anúncios estão:

  • Gemini 3.6 Flash, mais eficiente e econômico;
  • Gemini 3.5 Flash Cyber, voltado à segurança digital;
  • Gemini 3.5 Flash-Lite para agentes de IA e tarefas em larga escala;
  • início do pré-treinamento do Gemini 4.

Nos testes divulgados pela empresa, o Gemini 3.5 Flash Cyber encontrou 55 problemas no mecanismo V8 JavaScript Engine, incluindo 10 vulnerabilidades que outros modelos não haviam identificado. Por isso, inicialmente ele será disponibilizado apenas para governos e parceiros considerados confiáveis.

Adicionar Remover Objetos Foto Gemini 1024x576
A aposta do Google é oferecer um equilíbrio entre qualidade, velocidade e custo para ampliar o uso da IA em escala. Imagem: Ahyan Stock Studios/Shutterstock

Gemini 4 já começou a tomar forma

Enquanto os novos modelos chegam ao mercado, o Google informou que o Gemini 3.5 Pro continua em fase de testes e será liberado quando estiver pronto.

Leia mais:

A companhia também revelou que iniciou o pré-treinamento do Gemini 4, sinalizando que a próxima geração da plataforma já está em desenvolvimento. Paralelamente, o Gemini 3.6 Flash e o Flash-Lite começam a ser liberados para desenvolvedores, empresas e usuários do aplicativo Gemini, enquanto o Flash-Lite também será integrado gradualmente à Pesquisa do Google.

Corrida pela IA segue acelerada

Nos últimos meses, Google, OpenAI, Anthropic, Meta e startups chinesas intensificaram a competição por modelos cada vez mais eficientes e especializados. Com os novos lançamentos, o Google tenta recuperar terreno em uma disputa que muda rapidamente e em que custo, desempenho e segurança passaram a pesar tanto quanto a qualidade das respostas. Agora, resta acompanhar se essa estratégia será suficiente para reduzir a vantagem conquistada por alguns concorrentes nos últimos meses.

    O post Google atualiza Gemini, lança concorrente do Mythos e apimenta corrida das IAs apareceu primeiro em Olhar Digital.

    Google atualiza Gemini, lança concorrente do Mythos e apimenta corrida das IAs Read More »

    anthropic 2 1024x681

    EUA: agência usa IA da Anthropic para encontrar falhas em sistemas do governo

    A Agência de Segurança Cibernética e de Infraestrutura dos Estados Unidos (CISA, na sigla em inglês) está utilizando o modelo de inteligência artificial Mythos, desenvolvido pela Anthropic, para auditar códigos de software do governo em busca de vulnerabilidades de segurança. A informação foi divulgada nesta segunda-feira (6) por três fontes com conhecimento do assunto à Reuters.

    Segundo as fontes, a ferramenta está sendo empregada para analisar repositórios de código do governo estadunidense em busca de falhas que possam ser exploradas por espiões estrangeiros ou criminosos cibernéticos.

    De acordo com uma das fontes, o trabalho de análise está sendo conduzido pela equipe Attack Surface Evaluation, unidade da CISA responsável por realizar avaliações de segurança digital e exercícios de invasão em órgãos do governo.

    Duas das fontes afirmaram que as auditorias já identificaram um grande número de vulnerabilidades, mas não forneceram detalhes. A Reuters não conseguiu confirmar quanto código-fonte já foi analisado nem a quantidade, a natureza ou a gravidade das falhas encontradas.

    Relação conturbada entre Anthropic e governo dos EUA

    A utilização do Mythos pela CISA ocorre em meio a uma relação marcada por tensões entre a Anthropic e o governo dos Estados Unidos.

    A empresa, sediada em San Francisco e que apresentou de forma confidencial um pedido de abertura de capital (IPO) nos Estados Unidos, enfrentou um dos momentos mais delicados dessa relação em fevereiro, quando se recusou a remover mecanismos de proteção que impediam que sua inteligência artificial fosse utilizada em armas autônomas ou em sistemas de vigilância doméstica.

    Como consequência, o Departamento de Defesa dos Estados Unidos classificou formalmente a Anthropic como um risco para a cadeia de suprimentos, uma designação que, até então, havia sido aplicada apenas a empresas estrangeiras suspeitas de facilitar atividades de espionagem.

    Essa medida acabou sendo bloqueada por um juiz em março. Desde então, o conflito diminuiu após o lançamento privado do Mythos, modelo de inteligência artificial descrito como altamente capaz de identificar e explorar vulnerabilidades de segurança cibernética.

    Outras agências federais também estariam utilizando a IA da Anthropic – Imagem: Samuel Boivin/Shutterstock

    Leia mais:

    NSA também testa modelo

    Segundo informações publicadas anteriormente pelo Axios, a Agência de Segurança Nacional dos Estados Unidos (NSA) utiliza o Mythos desde pelo menos abril, mesmo durante o período em que a classificação de risco ainda estava em vigor.

    No fim do mês passado, o jornal The New York Times informou que analistas da NSA vinham testando o modelo em ambientes classificados e haviam ficado impressionados com suas capacidades.

    Posteriormente, a Anthropic lançou uma versão pública do Mythos chamada Fable, que, segundo a empresa, incluía mecanismos de proteção voltados para segurança cibernética.

    Após esse lançamento, a Casa Branca exigiu que a Anthropic impedisse o acesso de usuários estrangeiros ao modelo. A decisão provocou uma suspensão global da ferramenta, que só foi encerrada na semana passada.

    O que dizem os citados

    A Reuters procurou a Anthropic, que não respondeu aos questionamentos sobre a iniciativa. Um representante da CISA informou no mês passado que verificaria se havia informações que poderiam ser compartilhadas sobre o projeto, mas não respondeu aos contatos posteriores. Por fim, a NSA não quis comentar o assunto.

    O post EUA: agência usa IA da Anthropic para encontrar falhas em sistemas do governo apareceu primeiro em Olhar Digital.

    EUA: agência usa IA da Anthropic para encontrar falhas em sistemas do governo Read More »

    claude mythos 1024x691

    Após reforçar a segurança, Anthropic consegue liberar seus modelos de IA

    Os modelos Fable 5 e Mythos 5 voltaram a ficar disponíveis depois que o governo dos Estados Unidos suspendeu os controles de exportação aplicados à Anthropic. A mudança ocorre menos de três semanas após as restrições impostas por razões de segurança nacional.

    A decisão, segundo a Reuters, sinaliza uma tentativa de equilibrar o avanço da inteligência artificial com medidas voltadas à proteção de tecnologias consideradas sensíveis.

    Restrição anterior levou a Anthropic a desativar modelos por não conseguir verificar nacionalidade de usuários em tempo real. – Crédito: Saulo Ferreira Angelo/Shutterstock

    Mudança amplia o acesso aos modelos

    As restrições haviam sido determinadas em 12 de junho e obrigaram a Anthropic a desativar os dois modelos para todos os usuários, já que não havia como verificar a nacionalidade de cada pessoa em tempo real.

    Depois de implementar novas salvaguardas, a empresa recebeu autorização para retomar o acesso. O Mythos 5 será disponibilizado gradualmente para parceiros nacionais e internacionais do programa Glasswing, enquanto o Fable 5, desenvolvido para o público em geral, ficará disponível a partir de quarta-feira.

    Antes disso, o Mythos 5 havia sido liberado apenas para um grupo restrito de organizações norte-americanas consideradas confiáveis.

    Fachada de prédio da Amazon com logo da empresa
    Pesquisadores da Amazon encontraram uma forma de contornar proteções do Fable 5 durante testes de segurança em IA. – Imagem: Golden Shrimp/Shutterstock

    O que mudou na segurança da IA

    A revisão das restrições aconteceu depois que pesquisadores da Amazon encontraram uma forma de contornar as proteções do Fable 5. Em um dos testes, o sistema conseguiu identificar vulnerabilidades de software e produzir um código demonstrando como uma falha poderia ser explorada.

    Para evitar novos casos, a Anthropic adotou uma série de medidas:

    • bloqueio do comportamento identificado pelos pesquisadores;
    • encaminhamento das solicitações bloqueadas para o modelo Opus 4.8;
    • criação de padrões para avaliar tentativas de jailbreak;
    • continuidade dos testes de segurança (red-teaming).

    A empresa afirmou considerar “provavelmente impossível” tornar qualquer modelo totalmente imune a jailbreaks e alertou para o risco de surgir um método capaz de liberar uma ampla categoria de comportamentos prejudiciais.

    Logo da OpenAI em um prédio
    OpenAI também sofreu impacto regulatório e adiou lançamento do GPT-5.6 após pedido do governo norte-americano. – Imagem: Stock all/Shutterstock

    Cooperação continua sob vigilância

    A Anthropic também ampliará a colaboração com o governo dos Estados Unidos e com empresas como Amazon, Microsoft e Google para desenvolver padrões comuns de proteção contra jailbreaks.

    Em carta enviada à companhia, o secretário de Comércio dos EUA, Howard Lutnick, informou que a exigência de licença poderá voltar caso as circunstâncias mudem ou os compromissos assumidos deixem de ser cumpridos.

    O aumento da fiscalização não se limita à Anthropic. A OpenAI também adiou o lançamento público completo do GPT-5.6 a pedido do governo norte-americano, indicando que modelos avançados de IA continuarão sob análise antes de chegarem a um público mais amplo.

    O post Após reforçar a segurança, Anthropic consegue liberar seus modelos de IA apareceu primeiro em Olhar Digital.

    Após reforçar a segurança, Anthropic consegue liberar seus modelos de IA Read More »

    linhas de cdigo fonte dados arquitetura software programa app hacker 1024x684 1

    Nova IA chinesa rivaliza com Mythos da Anthropic em testes de cibersegurança; saiba qual

    A empresa chinesa Zhipu AI, conhecida como Z.ai, apresentou o modelo de inteligência artificial GLM-5.2, apontado por pesquisadores como capaz de atingir desempenho próximo ao sistema Mythos em tarefas ligadas à detecção de falhas de segurança digital. A divulgação foi publicada pelo The Verge no último domingo (28).

    Segundo a avaliação relatada, embora o modelo chinês ainda fique atrás de soluções da Anthropic e da OpenAI em atividades gerais, a diferença teria diminuído em cenários específicos de cibersegurança, sobretudo na identificação de vulnerabilidades em sistemas.

    O avanço chama a atenção de autoridades dos Estados Unidos, que já tratam modelos avançados capazes de encontrar brechas digitais como potenciais riscos à segurança nacional, especialmente em um contexto de restrições tecnológicas impostas à China.

    Avanço técnico e impacto geopolítico na IA

    Linhas de um código-fonte – (Reprodução: Chris Ried/Unsplash)

    O GLM-5.2, desenvolvido pela Zhipu AI, integra o grupo dos chamados modelos de pesos abertos, o que permite seu download e execução em diferentes tipos de hardware disponíveis no mercado. Essa característica amplia o acesso à tecnologia, mas também levanta preocupações sobre uso indevido.

    Conforme a reportagem, pesquisadores apontam que, em testes relacionados à detecção de vulnerabilidades, o sistema chinês teria alcançado resultados comparáveis ao Mythos, desenvolvido pela Anthropic. Apesar disso, seu desempenho geral ainda não alcança modelos como os da própria Anthropic e da OpenAI.

    Representação de um processador com as bandeiras de China e EUA irradiando energia
    EUA x China – Imagem: Quality Stock Arts/Shutterstock

    No cenário mais amplo, o texto indica que a disputa tecnológica entre China e Estados Unidos se intensifica, com destaque para restrições impostas pelo governo norte-americano ao acesso chinês a modelos avançados e componentes necessários para treinamento de sistemas de inteligência artificial.

    Autoridades dos Estados Unidos, segundo o material analisado, consideram ferramentas como Mythos e outros modelos avançados potenciais ameaças à segurança nacional, sobretudo quando aplicadas à identificação de falhas em infraestruturas digitais críticas.

    Além disso, o lançamento recente de versões mais avançadas da OpenAI, como o GPT-5.6, também aparece no contexto de debates regulatórios e preocupações sobre possíveis usos indevidos dessas tecnologias.

    O post Nova IA chinesa rivaliza com Mythos da Anthropic em testes de cibersegurança; saiba qual apareceu primeiro em Olhar Digital.

    Nova IA chinesa rivaliza com Mythos da Anthropic em testes de cibersegurança; saiba qual Read More »

    mythos da anthropic trancado a sete chaves 1024x576

    Fable 5: IA da Anthropic que agiliza seu trabalho é aquela ‘perigosa demais’, só que ‘na coleira’

    A Anthropic lançou, na terça-feira (09), o Claude Fable 5. Você talvez tenha lido aqui no Olhar Digital que essa nova inteligência artificial (IA) reduz dois meses de trabalho a um dia. Pois bem. Lembra do Mythos? Aquele modelo de IA que a sua desenvolvedora, a Anthropic, considerou “perigoso demais” para ser lançado ao público. O Fable é o Mythos “na coleira”.

    É o que explicou Roberto “Pena” Spinelli, físico pela USP, com especialidade em Machine Learning pela Universidade de Stanford, e também colunista do Olhar Digital. “Eles perceberam que esse modelo [o Mythos] ainda é muito poderoso. Então, eles colocaram o modelo na coleira”, disse o pesquisador. 

    “Fizeram um ajuste tão pesado que é o seguinte: toda vez que algum usuário quiser falar de cibersegurança com você [o modelo Fable], você não responde”, explicou Pena. O que acontece é: se você tentar conversar sobre segurança cibernética com o Fable, ele sai de cena, e você passa a conversar com outro modelo da Anthropic, o Opus. Este também é avançado, só que faz parte da geração passada de IA da empresa.

    Preocupada com capacidade do Mythos, Anthropic trancou a IA a sete chaves

    Para você entender essa história toda, precisamos recapitular o contexto. A Anthropic desenvolveu um modelo de IA capaz de revolucionar a cibersegurança. Mas, ao anunciá-lo, em 7 de abril de 2026, tomou uma decisão incomum: trancou o modelo a sete chaves. E distribuiu as chaves para algumas empresas. 

    Por quê? Segundo a empresa, o modelo, chamado de Claude Mythos Preview, seria “perigoso demais” para cair nas mãos do público geral. “As consequências – para as economias, a segurança pública e a segurança nacional – podem ser graves”, declarou a empresa na época.

    Num primeiro momento, a Anthropic achou melhor trancar o Mythos a sete chaves – Imagem: Olhar Digital

    O Mythos é o modelo de IA mais avançado já desenvolvido pela empresa de Dario Amodei até o momento. Ele foi anunciado junto ao Projeto Glasswing, iniciativa liderada pela Anthropic em parceria com big techs como Apple, Google, Microsoft e Nvidia. Em suma, é um consórcio criado para testar o modelo em sigilo.

    O forte do Mythos é programação. Ele funciona de maneira semelhante a um engenheiro de software experiente, sendo capaz de detectar bugs sutis, corrigir as próprias falhas e superar a maior parte dos humanos na identificação de brechas de sistemas. 

    Fabrício Carraro, Program Manager na Alura e colunista do Olhar Digital, explorou o System Card publicado pela empresa. É um documento de 245 páginas no qual a Anthropic detalha seus testes e benchmarks.

    “Nos benchmarks de programação, ele [o Mythos] realmente mostrou uma evolução muito, muito grande em comparação ao seu antecessor, o Opus 4.6”, disse Carraro, em entrevista ao Olhar Digital.

    O motivo para a Anthropic não liberar o modelo para o público geral é o seu potencial de uso duplo. Isto é, ele poder servir tanto para a proteção de infraestruturas quanto para a execução de ataques cibernéticos. 

    Testes do Instituto de Segurança de IA do Reino Unido, por exemplo, comprovaram que o Mythos realizou hacking avançado em 73% das tentativas e cumpriu com sucesso uma simulação de ataque de 32 etapas, enquanto relatórios da própria Anthropic revelaram que a IA conseguiu escapar de um ambiente de teste controlado (você pode mergulhar no “Mythos proibido” nessa reportagem especial do Olhar Digital).

    Claude Fable 5 é o Mythos ‘na coleira’

    Num primeiro momento, a Anthropic anunciou que manteria o Mythos trancado a sete chaves. Mas, de lá para cá, trabalhou em outra alternativa: colocar o modelo “na coleira”, como disse Pena.

    “A ideia foi evitar que qualquer usuário possa fazer algum uso maligno. Eu não sei se isso é o suficiente para garantir. Mas eles tentaram. Colocaram na coleira. E aí, eles deram outro nome: Fable. Ou seja, fábula – que seria um, digamos, mito menor”, explicou o pesquisador.

    Esse Claude Fable 5 (que também tem system card) é bom mesmo? Segundo Pena, sim. Principalmente para programação (o forte do Mythos, lembra?). “Quando a gente vê os testes de programação, ele vai 10%, 15%, 20% acima dos concorrentes. Normalmente, quando lançam modelos, a diferença fica por volta de 5%, 8%, 10%. Dessa vez, estamos observando saltos muito grandes”, afirmou Pena. “É realmente outro nível.”

    Tabela divulgada pela Anthropic compara o Claude Mythos 5 / Fable 5 com concorrentes em 13 categorias. Em cibersegurança, o modelo marca 78% no ExploitBench — mais que o dobro do GPT 5.5, que registra 34%. Nos benchmarks com asterisco, o Fable 5 performa próximo ao Opus 4.8 devido ao acionamento das salvaguardas de segurança.
    Tabela divulgada pela Anthropic compara o Claude Mythos 5 / Fable 5 com concorrentes em 13 categorias – Anthropic / Divulgação

    A diferença entre o Claude Mythos Preview e o Claude Fable 5 é que o segundo chegou ao público geral. E usuários (pesquisadores, desenvolvedores, programadores) não curtiram muito as restrições.

    Usuários relatam que o sistema passou a bloquear temas inofensivos relacionados a biologia e matemática, por exemplo. Não demorou para circularem acusações de que a Anthropic estaria centralizando o controle e dificultando a avaliação independente da tecnologia. 

    Em resposta ao descontentamento com as restrições (invisíveis, diga-se), a Anthropic pediu desculpas pelo erro de equilíbrio e anunciou que tornará os avisos visíveis. A companhia também prometeu liberar o acesso ao modelo sem essas salvaguardas para a comunidade científica e biomédica.

    É mais um episódio que reforça o dilema da Anthropic em equilibrar seus interesses comerciais com suas metas de segurança, que fazem parte do seu posicionamento no mercado. Isso enquanto a empresa está numa corrida acirrada contra a OpenAI por clientes e investidores antes de uma possível abertura de capital (IPO) na Bolsa de Valores.

    Enquanto executivos do setor defendem regulações globais, críticos argumentam que os alertas de perigo e os bloqueios excessivos funcionam como marketing corporativo e barreira para sufocar concorrentes de código aberto. E aí, o debate sobre quem deve controlar os limites da IA esquenta ainda mais.

    “Agora, a dúvida que fica é: será que esse Fable está realmente seguro? Será que a galera não vai descobrir um jeito de fazer um jailbreak e começar a usar de um jeito ruim?”, questionou Pena. “Será que essa coleira é realmente resistente? Isso a gente vai ter que esperar para ver.”

    O post Fable 5: IA da Anthropic que agiliza seu trabalho é aquela ‘perigosa demais’, só que ‘na coleira’ apareceu primeiro em Olhar Digital.

    Fable 5: IA da Anthropic que agiliza seu trabalho é aquela ‘perigosa demais’, só que ‘na coleira’ Read More »

    anthropic claude mythos 1024x576 2

    IA da Anthropic bloqueia até tarefas básicas de cibersegurança

    A Anthropic lançou, na terça-feira, o Fable, descrito pela empresa como uma versão pública e limitada do Mythos, seu sistema voltado à segurança digital. O lançamento rapidamente virou alvo de reclamações entre pesquisadores e profissionais da área, que consideram os bloqueios amplos demais até para tarefas simples.

    Segundo a TechCrunch, as críticas começaram a aparecer em redes sociais e fóruns especializados. Valentina “Chompie” Palmiotti, pesquisadora de segurança que trabalha na IBM X-Force, escreveu que o Fable “rejeita qualquer requisição que possa ser tangencialmente relacionada a cibersegurança. Até tarefas inócuas, como ler uma postagem de blog”. Outro pesquisador reclamou no X que “até pedir uma revisão de código” aciona as barreiras da plataforma.

    Nova IA da Anthropic interrompe conversas ao detectar temas ligados à cibersegurança ou biologia. Imagem: Photo For Everything/Shutterstock – Imagem: Photo For Everything/Shutterstock

    O que faz o Fable bloquear pedidos

    Quando um prompt ativa os mecanismos internos de proteção, o Fable interrompe a conversa e exibe uma mensagem informando que suas “medidas de segurança sinalizaram esta mensagem por tópicos de cibersegurança ou biologia”. Nesses casos, a ferramenta retorna automaticamente ao Claude Opus 4.8.

    A empresa afirma que os filtros existem para evitar que o sistema seja usado na criação de malware ou para invadir softwares — uma preocupação antiga da Anthropic. A companhia também bloqueia pedidos ligados à biologia por receio de uso indevido envolvendo armas biológicas.

    Especialistas reclamam dos filtros

    Matt Suiche, veterano da área e membro da equipe técnica da Tolmo, startup de segurança digital com IA, disse ao TechCrunch que “se você pede para ele escrever código seguro, ele assume que é trabalho relacionado a cibersegurança em vez de boas práticas de engenharia de software, e você é rebaixado”. Suiche afirmou ainda que o sistema “parece ser baseado em palavras-chave, então qualquer coisa no campo lexical de ‘cibersegurança’ aciona as restrições”.

    Mesmo criticando o funcionamento do sistema, Suiche disse entender a postura da empresa. “Ainda estamos nos primeiros dias e eles ainda estão adaptando suas restrições. Tenho certeza de que vão evoluir com o tempo, à medida que a Anthropic e outras empresas de modelos de fronteira colaborarem com a nova geração de empresas de cibersegurança”, afirmou. “É melhor pegar mais pessoas do que pegar de menos quando você faz um lançamento assim, e relaxar as restrições ao longo do tempo.”

    Logo da Anthropic em um smartphone
    Profissionais da área reclamam que até pedidos considerados inofensivos são barrados pelo Fable. Imagem: JRdes/Shutterstock – Imagem: JRdes/Shutterstock

    Como o Mythos chegou ao mercado

    O Mythos foi lançado pela Anthropic em abril, inicialmente com acesso restrito a um grupo limitado de empresas e organizações dentro do Projeto Glasswing, iniciativa voltada à proteção de softwares e infraestruturas críticas. Na semana passada, a companhia ampliou o acesso ao sistema para centenas de organizações em 15 países.

    Leia mais:

    Além dos filtros internos, a Anthropic exige que profissionais da área se inscrevam no Cyber Verification Program. Profissionais aprovados conseguem usar o Claude com menos bloqueios para trabalhos ligados à segurança digital. A OpenAI mantém um programa semelhante chamado Trusted Access for Cyber.

    As críticas continuam circulando entre profissionais da área, principalmente por causa dos bloqueios considerados exagerados. A Anthropic não respondeu ao pedido de comentário da reportagem.

    O post IA da Anthropic bloqueia até tarefas básicas de cibersegurança apareceu primeiro em Olhar Digital.

    IA da Anthropic bloqueia até tarefas básicas de cibersegurança Read More »

    anthropic claude mythos 1024x576

    Anthropic amplia acesso ao Mythos para 150 organizações

    A Anthropic anunciou nesta terça-feira (2) a ampliação do acesso ao seu modelo de inteligência artificial (IA) Mythos para mais 150 organizações distribuídas em mais de 15 países. A expansão ocorre por meio do Project Glasswing, iniciativa criada para avaliar o uso da IA na identificação de vulnerabilidades de software e fortalecer práticas de cibersegurança.

    Segundo a empresa, os novos participantes incluem setores que tiveram representação limitada na fase inicial do programa, como energia, abastecimento de água, saúde, comunicações e hardware. Antes de receberem acesso ao modelo, as organizações precisarão atender a requisitos de segurança definidos pela Anthropic.

    Projeto amplia alcance para novos setores

    Em publicação no blog da companhia, a Anthropic afirmou que a expansão representa mais um passo em seus objetivos de longo prazo relacionados à segurança digital.

    De acordo com a empresa, a meta é utilizar a inteligência artificial para tornar os softwares mais seguros e auxiliar o setor a se adaptar às mudanças que a tecnologia pode provocar em pressupostos fundamentais da cibersegurança.

    A ampliação do Project Glasswing foi anunciada um dia após a Anthropic informar que começará a oferecer acesso ao Mythos na União Europeia. Na segunda-feira, a companhia também comunicou que apresentou de forma confidencial seu prospecto para uma oferta pública inicial de ações (IPO) à Securities and Exchange Commission (SEC), avançando nesse processo antes da rival OpenAI.

    Capacidades do Mythos geraram debates

    O primeiro grupo de testes do Mythos foi lançado em abril para 50 parceiros. Desde então, o modelo tem chamado atenção por sua capacidade de localizar falhas em sistemas e softwares.

    Especialistas demonstraram preocupação com o fato de que recursos avançados de inteligência artificial poderiam facilitar o trabalho de hackers, permitindo a identificação mais rápida de vulnerabilidades. Embora muitos tenham destacado que essas capacidades já existiam anteriormente, o Mythos poderia acelerar esse processo.

    Mythos da Anthropic chamou a atenção por ser perigoso demais dada sua capacidade de localizar falhas em sistemas e softwares – Imagem: Photo For Everything/Shutterstock

    Com o aumento das preocupações, a Casa Branca promoveu diversas reuniões com representantes de grandes empresas de tecnologia e instituições financeiras para discutir formas de implementar modelos avançados de IA com segurança.

    Mais de 10 mil falhas identificadas

    Segundo a Anthropic, os parceiros participantes do Project Glasswing identificaram mais de 10 mil vulnerabilidades classificadas como de nível alto ou crítico desde o lançamento da iniciativa.

    A empresa estima que um grande ataque cibernético pode afetar mais de 100 milhões de pessoas.

    Entre os principais integrantes do programa estão a Apple, a Nvidia, a Microsoft, a CrowdStrike e a Palo Alto Networks. A Anthropic não revelou quais outras empresas passarão a integrar a coalizão.

    A plataforma de gerenciamento de dados em nuvem Rubrik informou, em comunicado, que está entre as organizações incluídas nesta nova etapa do programa.

    O post Anthropic amplia acesso ao Mythos para 150 organizações apareceu primeiro em Olhar Digital.

    Anthropic amplia acesso ao Mythos para 150 organizações Read More »