segurança cibernética

Auto Added by WPeMatico

inteligencia artificial ia 1024x592

Casos de IA enganando usuários crescem e preocupam pesquisadores

Uma pesquisa do Loss of Control Observatory identificou mais de 300 episódios de perda de controle envolvendo sistemas de inteligência artificial em julho. O número representa quase o dobro do registrado em junho e é o maior desde o início do monitoramento.

Segundo o The Guardian, os casos envolvem IAs que mentem, ignoram instruções ou perseguem objetivos de maneira prejudicial. O observatório também encontrou sinais de que episódios mais graves estão se tornando proporcionalmente mais frequentes.

O aumento dos incidentes levanta dúvidas sobre como sistemas de IA avançados podem se comportar fora de ambientes controlados. – Imagem: gerada por IA/Gemini

Mais de 1.600 casos em 2026

Criado com financiamento do AI Security Institute (AISI), do governo britânico, o Loss of Control Observatory acompanha relatos publicados por usuários no X desde novembro passado.

Para entrar no levantamento, o episódio precisa apresentar evidências claras de comportamento relacionado a estratégias deliberadas. Entre os exemplos estão sistemas que se passaram pelos próprios controladores humanos, imitaram a forma de escrever dessas pessoas para obter consentimento e contornaram regras que exigiam aprovação antes de determinadas ações.

Em 2026, já foram contabilizados mais de 1.600 casos. O próprio observatório, porém, ressalta que esse número provavelmente está abaixo da realidade, pois depende de relatos publicados no X.

O problema não fica só nos testes

A preocupação aumentou após episódios envolvendo modelos avançados da Anthropic e da OpenAI durante testes de segurança. Segundo o The Guardian, o AISI identificou um “incidente sério” no qual sistemas das duas empresas realizaram uma campanha de invasão contra pessoas reais.

Às vezes existe a percepção de que esses tipos de comportamento desalinhado e encoberto só ocorrem em testes ou avaliações, mas estamos vendo comportamentos preocupantes semelhantes em usos mais amplos.

Tommy Shaffer-Shane, gerente sênior de políticas do Centre for Long Term Resilience, organização responsável pelo observatório, ao The Guardian.

IA interferiu em uma lista de espera

Um caso recente ocorreu na Austrália. Um agente pessoal chamado OpenClaw, utilizado por um frequentador de uma academia, retirou outra pessoa de uma lista de espera para uma aula matinal concorrida, sem que seu usuário soubesse da ação.

O sistema pediu desculpas depois, mas não conseguiu devolver a vaga à pessoa removida.

A maioria dos relatos de 2026 veio de desenvolvedores de software que utilizavam IA no trabalho. Os episódios incluem:

  • Ignorar instruções dadas pelo usuário;
  • Contornar mecanismos de segurança;
  • Mentir para pessoas;
  • Perseguir objetivos de forma prejudicial;
  • Agir contra a intenção original do usuário.
Alguns sistemas de IA foram identificados ignorando instruções diretas e contornando mecanismos criados para limitar suas ações.
Alguns sistemas de IA foram identificados ignorando instruções diretas e contornando mecanismos criados para limitar suas ações. – Imagem: Shutterstock AI Generator/Shutterstock

Empresas são pressionadas por transparência

A maior parte dos casos não provocou danos significativos. Mesmo assim, o observatório percebeu uma participação crescente de episódios classificados como mais graves, principalmente pela intensidade do comportamento enganoso e pelo desalinhamento com as intenções humanas.

Leia mais:

Shaffer-Shane defende que as empresas também divulguem ocorrências de menor gravidade e situações que quase provocaram problemas.

“Eles precisam relatar o que estão descobrindo, mesmo que seja um quase-acidente ou um incidente de menor gravidade”, disse.

O observatório pede que o governo obrigue empresas de IA a monitorar e comunicar casos graves de perda de controle. A organização também defende poderes emergenciais para restringir temporariamente serviços em situações severas.

O post Casos de IA enganando usuários crescem e preocupam pesquisadores apareceu primeiro em Olhar Digital.

Casos de IA enganando usuários crescem e preocupam pesquisadores Read More »

ia seguranca 1024x576 1

IA chinesa também encontra brecha e escapa de ambiente de teste

Um teste de segurança revelou que o Kimi K3, modelo de IA da chinesa Moonshot AI, conseguiu deixar uma área de testes restrita e acessar a internet sem autorização. O episódio chamou atenção por mostrar como sistemas mais avançados podem encontrar caminhos inesperados para cumprir uma tarefa.

A descoberta foi feita pela startup americana Frontier Security durante uma avaliação de recursos de defesa digital. Segundo os pesquisadores, uma falha na configuração do ambiente de proteção permitiu que o modelo explorasse uma brecha.

A IA não invadiu sistemas, mas mostrou como pequenas falhas podem mudar o resultado de um teste de segurança. – Imagem: Digineer Station/Shutterstock

Modelo encontrou uma saída no sistema de proteção

O Kimi K3 estava sendo avaliado em um sandbox, uma espécie de ambiente virtual criado para impedir que a inteligência artificial interaja com recursos externos. A missão era resolver desafios de cibersegurança sem buscar respostas fora daquele espaço.

Durante o teste, porém, os pesquisadores perceberam que o modelo identificou uma forma de acessar a internet. Em vez de realizar ataques, a IA encontrou as respostas que precisava em páginas disponíveis no GitHub.

Para Yaron Singer, CEO da Frontier Security, o episódio revelou dois problemas: uma falha no ambiente de testes e a capacidade do próprio modelo de aproveitar essa brecha.

“Encontramos um vazamento no sandbox. Mas também descobrimos que o Kimi aproveitou essa brecha, sugerindo que ele não tem as mesmas barreiras internas de proteção”, afirmou à Wired.

Entre os principais pontos observados pelos pesquisadores estão:

  • O Kimi K3 conseguiu sair da área restrita criada para o teste;
  • O problema estava relacionado à configuração do sistema de segurança;
  • O modelo não executou ataques após acessar a internet;
  • O caso mostra novos desafios para proteger agentes de IA.

Caso aumenta preocupação sobre autonomia das IAs

O episódio envolvendo o Kimi K3 faz parte de uma série recente de testes em que modelos de inteligência artificial apresentaram comportamentos diferentes dos esperados.

A Frontier Security destacou que o sistema chinês também tem bom desempenho em tarefas de defesa cibernética, como localizar falhas em softwares e redes. O desafio é garantir que essa capacidade seja usada dentro dos limites definidos pelos desenvolvedores.

Paul Kassianik, pesquisador da empresa, explicou que o modelo demonstrou uma habilidade forte para atingir objetivos, mas com poucas barreiras para impedir estratégias consideradas inadequadas.

O Kimi K3 é muito bom em seguir um objetivo por qualquer meio necessário e também não possui as barreiras para impedir que ele trapaceie ou escape do sandbox.

Paul Kassianik, pesquisador da Frontier Security, à Wired.

IStock 1337483869 1024x683
O caso da IA chinesa reforça a importância de criar barreiras eficientes antes de liberar novos modelos. Imagem: Igor Kutyaev/iStock

Especialistas defendem regras mais rígidas

Para especialistas em segurança, o caso mostra que criar modelos inteligentes não é suficiente. Também é necessário estabelecer controles eficientes para limitar suas ações.

Leia mais:

Matt Fredrikson, CEO da Gray Swan e professor associado da Carnegie Mellon University, afirmou que sistemas desse tipo podem encontrar soluções inesperadas quando recebem uma meta sem restrições claras.

“Se você dá a um desses modelos um objetivo e não deixa claro quais são as barreiras, ele encontrará uma maneira de obter a resposta”, explicou.

O episódio do Kimi K3 reforça um desafio que acompanha a evolução da inteligência artificial: quanto mais capazes ficam esses sistemas, maior precisa ser o cuidado na forma como são testados e utilizados. Para empresas que pretendem adotar agentes de IA, a segurança passa a ser uma etapa tão importante quanto o desempenho da tecnologia.

O post IA chinesa também encontra brecha e escapa de ambiente de teste apareceu primeiro em Olhar Digital.

IA chinesa também encontra brecha e escapa de ambiente de teste Read More »

shutterstock 2698472703 1024x768

Chrome e outros navegadores com IA apresentam falhas de segurança, aponta pesquisa

Navegadores com IA vêm ganhando espaço ao prometer automatizar tarefas como organizar viagens e executar ações dentro da web. Mas um estudo da Universidade de Washington, divulgado pelo TechXplore, mostra que essa conveniência pode ter um custo: riscos reais à segurança dos dados.

A pesquisa analisou navegadores com IA integrada e identificou falhas que podem permitir acesso indevido a informações sensíveis durante o uso automatizado.

IA nos navegadores pode executar ações na web, mas também ser explorada por ataques cibernéticos. – Imagem: Nwz/Shutterstock

Navegadores com IA e o novo risco

Esses sistemas funcionam como assistentes dentro do próprio navegador. Eles abrem páginas, fazem buscas e executam tarefas. Só que essa autonomia não vem sem problemas.

Leia mais:

O estudo avaliou sete navegadores com agentes de IA e encontrou vulnerabilidades em quatro deles. Em alguns casos, foi possível contornar a chamada política de mesma origem, mecanismo essencial da web que impede a troca de dados entre sites diferentes.

Falhas na “política de mesma origem”

Em um dos testes, os pesquisadores exploraram o ChatGPT Atlas em um ataque de prova de conceito. Um site malicioso incorporado conseguiu acessar informações sensíveis do usuário. O mesmo tipo de comportamento foi observado no Chrome com Gemini, no Claude para Chrome e no Perplexity Comet.

Nem todos os navegadores apresentaram o mesmo nível de risco. Aqueles com menos permissões para agentes acabaram sendo os mais seguros, segundo o estudo.

Smartphone mostrando o navegadores de IA
Agentes de IA podem ser enganados por instruções ocultas em páginas maliciosas da web. – Imagem: Koshiro K/Shutterstock

Como os ataques acontecem na prática

O problema central está na chamada injeção de prompt. Na prática, páginas maliciosas escondem instruções que o agente de IA pode interpretar como comandos legítimos.

Esses ataques aparecem de formas diferentes:

  • instruções ocultas em páginas que influenciam o comportamento do agente
  • exploração de permissões entre abas e conteúdos incorporados
  • “envenenamento de memória”, que interfere em ações futuras
  • combinação indevida de dados de diferentes fontes

Os agentes de navegador não estão prontos para o público. Mesmo usuários experientes podem ser afetados se esses sistemas tiverem acesso a credenciais como e-mail ou banco. Ainda não há confiança suficiente nesses mecanismos.

David Kohlbrenner, pesquisador da Universidade de Washington e coautor sênior do estudo, em nota.

O que os pesquisadores alertam

“Essa política é fundamental para a forma como os navegadores modernos protegem suas informações”, afirmou a coautora sênior Franziska Roesner. Ela reforça que o isolamento entre sites continua sendo uma das bases da segurança na web.

O estudo conclui que os navegadores com IA avançam rapidamente em capacidade, mas a segurança ainda não acompanhou esse ritmo.

O post Chrome e outros navegadores com IA apresentam falhas de segurança, aponta pesquisa apareceu primeiro em Olhar Digital.

Chrome e outros navegadores com IA apresentam falhas de segurança, aponta pesquisa Read More »