openai

Auto Added by WPeMatico

openai 2 1024x670

OpenAI lança GPT-6 Sol e Luna, novos modelos de IA que prometem mais desempenho por menos dinheiro

A OpenAI ampliou nesta terça-feira (22) sua nova geração de modelos de inteligência artificial (IA) com o lançamento do GPT-6 Sol e do GPT-6 Luna. As duas versões chegam depois do GPT-6 Astra, apresentado pela empresa no início de setembro, e foram desenvolvidas para oferecer parte dos avanços da geração mais potente com custos menores.

Segundo a OpenAI, Sol e Luna foram treinados com métodos semelhantes aos utilizados no Astra, incorporando avanços em áreas, como trabalho profissional, programação, uso de computadores, factualidade e alinhamento.

A principal diferença está na relação entre capacidade e custo. A empresa afirma que melhorias no armazenamento em cache e na inferência permitiram reduzir em 50% os preços de acesso pela API em comparação com os valores promocionais dos modelos GPT-5.6 correspondentes.

GPT-6 Sol e Luna custam menos

  • Na API da OpenAI, o GPT-6 Sol passa a custar US$ 2 (R$ 10,24) por milhão de tokens de entrada e US$ 10 (R$ 51,20) por milhão de tokens de saída;
  • No GPT-5.6 Sol, os valores promocionais anteriores eram de US$ 4 (R$ 20,48) e US$ 20 (R$ 102,40), respectivamente;
  • Já o GPT-6 Luna custa US$ 0,10 (R$ 0,51) por milhão de tokens de entrada e US$ 0,50 (R$ 2,56) por milhão de tokens de saída;
  • No GPT-5.6 Luna, os preços promocionais eram de US$ 0,20 (R$ 1,02) e US$ 1,20 (R$ 6,14);
  • A companhia destaca que a redução de custos foi pensada para permitir que desenvolvedores executem mais tarefas e façam mais iterações com os modelos;
  • O GPT-6 Astra, por sua vez, continua sendo apresentado pela OpenAI como o modelo de maior capacidade da família para quem busca o desempenho máximo.

Foco em programação e agentes de IA

O GPT-6 Sol recebeu atenção especial para tarefas profissionais e de programação. A OpenAI afirma que o modelo apresenta avanços significativos em relação ao GPT-5.6 Sol em testes voltados para agentes capazes de trabalhar em bases de código reais.

No benchmark FrontierCode 1.1 Main, que avalia não apenas se o código funciona, mas também aspectos como qualidade dos testes, organização e aderência aos padrões do projeto, a empresa afirma que o Sol apresentou melhora significativa em relação ao antecessor.

Em outro teste, o DeepSWE v1.1, voltado para tarefas complexas de engenharia de software em projetos reais, o GPT-6 Sol atingiu 68,8% com esforço máximo. Segundo a OpenAI, o resultado ficou a 1,1 ponto percentual da maior pontuação do Claude Fable 5, de 69,9%, mas com custo aproximadamente 80% menor por tarefa. O GPT-6 Luna também apresentou desempenho de 66,6% no mesmo teste, de acordo com a empresa.

Esses recursos também chegam ao Codex, plataforma da OpenAI voltada para tarefas de programação. A companhia afirma que os custos menores dos novos modelos podem permitir que desenvolvedores executem mais tarefas de codificação e agentes de IA.

Desempenho em tarefas profissionais

A OpenAI também destacou resultados do GPT-6 Sol em tarefas profissionais que envolvem múltiplos aplicativos e ferramentas.

No AutomationBench, que testa agentes em fluxos de trabalho de vendas, marketing, operações, suporte, finanças e recursos humanos, o Sol, com esforço máximo, atingiu 33,2%, segundo a empresa.

A OpenAI afirma que esse resultado superou o Claude Opus 5 com esforço máximo, que marcou 26,9% no teste citado pela companhia. O custo estimado por tarefa também teria sido significativamente menor para o Sol.

Em outro teste, chamado Agents’ Last Exam, o GPT-6 Sol atingiu 56,4% com esforço máximo. A OpenAI afirma que o resultado ficou acima da maior pontuação do Claude Opus 5 registrada na avaliação, de 60%, mas com custo 60% menor por tarefa.

OpenAI afirma que esse resultado superou o Claude Opus 5 com esforço máximo, que marcou 26,9% no teste citado pela companhia – Imagem: Camilo Concha/Shutterstock

Leia mais:

Modelos também melhoram uso do computador

O uso de computadores é outra área destacada pela OpenAI.

No teste OSWorld 2.0 offline, o GPT-6 Sol, com esforço extra, atingiu 60,5%, segundo a empresa, contra 60,3% do Claude Opus 5 com esforço médio. A OpenAI afirma que o resultado foi obtido com aproximadamente 80% menos custo por tarefa.

O GPT-6 Luna, por sua vez, teria superado o GPT-5.6 Sol com esforço médio no mesmo tipo de avaliação, custando cerca de um décimo do valor por tarefa.

Apesar dos avanços, a OpenAI mantém o GPT-6 Astra como seu modelo de referência para uso de computadores.

Respostas mais claras e menos verbosas

Além dos ganhos técnicos, Sol e Luna também receberam mudanças no estilo de comunicação introduzido no GPT-6 Astra.

A OpenAI afirma que os novos modelos devem apresentar respostas mais claras, com menos jargões, menos construções estranhas e menos detalhes considerados de baixo valor. A empresa também espera respostas um pouco mais curtas, sem perda de conteúdo.

A mudança deve ser especialmente perceptível em conversas técnicas e relacionadas a programação.

Expansão da família GPT-6

O lançamento de Sol e Luna amplia rapidamente a família GPT-6. O primeiro modelo da geração, o GPT-6 Astra, foi apresentado no início de setembro com foco em tarefas, como programação, pesquisa científica, uso de computadores, cibersegurança e trabalho profissional.

Agora, a OpenAI passa a oferecer modelos com diferentes combinações de capacidade e custo. O Astra permanece no topo da linha, enquanto Sol e Luna buscam levar parte dos recursos da nova geração para tarefas que exigem maior volume de processamento.

A chegada dos dois modelos também reforça a estratégia da empresa de reduzir o custo de execução de agentes e aplicações de IA, especialmente em cenários nos quais os sistemas precisam realizar muitas operações consecutivas.

Sol e Luna já estão sendo disponibilizados pela OpenAI em seus produtos e pela API, ampliando o acesso à nova geração de modelos.

O post OpenAI lança GPT-6 Sol e Luna, novos modelos de IA que prometem mais desempenho por menos dinheiro apareceu primeiro em Olhar Digital.

OpenAI lança GPT-6 Sol e Luna, novos modelos de IA que prometem mais desempenho por menos dinheiro Read More »

ia seguranca 1024x576 1

OpenAI pede que EUA liderem criação de padrões globais para controlar riscos de IAs avançadas

A OpenAI quer que os Estados Unidos liderem um esforço internacional para criar padrões técnicos globais para sistemas de inteligência artificial (IA) de fronteira, incluindo tecnologias capazes de realizar aprimoramento recursivo de suas próprias capacidades.

A proposta foi apresentada pela empresa em publicação nesta segunda-feira (21), enquanto líderes mundiais se reúnem para a Assembleia Geral das Nações Unidas (ONU). A iniciativa ocorre em meio ao debate internacional sobre como acompanhar o avanço de sistemas de IA cada vez mais capazes.

A OpenAI defende a criação de mecanismos que permitam estabelecer padrões nacionais e internacionais complementares, além de métricas comuns e protocolos para comunicação de incidentes. Segundo a empresa, a ideia é facilitar a comparação de evidências, a avaliação de riscos e a resposta coletiva a problemas relacionados à IA.

O foco no aprimoramento recursivo

  • Um dos principais pontos da proposta é o chamado aprimoramento recursivo (RSI, na sigla em inglês), processo no qual sistemas de IA passam a realizar cada vez mais tarefas relacionadas ao desenvolvimento de novas gerações de IA;
  • A OpenAI afirma que pesquisas automatizadas podem envolver diferentes níveis de supervisão humana. À medida que os sistemas assumem mais trabalho no desenvolvimento de sucessivas gerações de IA, eles poderiam conduzir um processo de aprimoramento recursivo, potencialmente acelerando o ritmo de avanço da tecnologia;
  • A empresa ressalta, porém, que o RSI totalmente autônomo não está acontecendo atualmente e que não deveria ser buscado enquanto não for possível realizá-lo com segurança;
  • Segundo a OpenAI, o avanço nessa área deve depender da capacidade de preservar o controle humano e de decisões democráticas informadas sobre seus benefícios e riscos. A empresa alerta que, sem supervisão adequada, humanos poderiam perder o controle prático sobre o desenvolvimento da IA e deixar de compreender os próprios processos de pesquisa realizados pelos sistemas.

Padrões internacionais

Para a OpenAI, padrões internacionais de segurança e proteção para o desenvolvimento de IA de fronteira podem ser tão importantes quanto pesquisas de alinhamento para acompanhar o avanço da tecnologia.

A empresa aponta três desafios principais que justificariam uma coordenação internacional:

  • Fragmentação: diferentes países podem adotar avaliações, exigências de comunicação e definições de incidentes incompatíveis entre si;
  • Ação coletiva: países agindo individualmente podem produzir resultados que nenhum deles desejaria, especialmente diante da possibilidade de aceleração da pesquisa por sistemas de IA;
  • Capacidade desigual: conhecimentos e atividades relacionados ao desenvolvimento de IA de fronteira estão distribuídos de maneira desigual entre os países.

A OpenAI afirma que esses desafios abrangem tanto modelos abertos quanto fechados.

A empresa também defende que laboratórios que desenvolvem pesquisa automatizada ou outras capacidades avançadas sejam responsáveis por fazê-lo com segurança, respeitando princípios básicos de responsabilidade própria e as leis existentes.

Como funcionaria a proposta

Uma das possibilidades apresentadas pela OpenAI seria aproveitar a rede de institutos nacionais de segurança em IA já criada em países, como Austrália, Canadá, Alemanha, França, Quênia, Japão, Coreia do Sul, Singapura, Índia e Reino Unido.

Essas instituições poderiam ajudar na definição de padrões por meio do Center for AI Standards and Innovation (CAISI) e de organismos nacionais do setor, com foco em modelos de IA de fronteira e no gerenciamento de benefícios e riscos associados à pesquisa automatizada, incluindo o RSI.

Os padrões serviriam como uma base técnica comum para medir e avaliar capacidades, analisar riscos e verificar a suficiência de mecanismos de proteção.

A OpenAI esclarece que esses padrões não seriam licenças, revisões obrigatórias antes do lançamento ou requisitos de aprovação para modelos de IA. Caberia aos governos nacionais decidir se e como incorporá-los aos próprios sistemas legais.

A empresa também afirma que o processo deveria consultar desenvolvedores de modelos abertos e fechados, especialistas técnicos independentes e universidades. A proposta é que os padrões sejam desenvolvidos de maneira transparente e não favoreçam empresas, países ou modelos de negócio específicos.

Uma das possibilidades apresentadas pela OpenAI seria aproveitar a rede de institutos nacionais de segurança em IA já criada em alguns países – Imagem: Summit Art Creations/Shutterstock

Leia mais:

Métricas e comunicação de incidentes

A segunda parte da proposta envolve a criação de medições e protocolos comuns para comunicação de incidentes.

Entre os possíveis padrões citados pela OpenAI estão:

  • Avaliação do avanço de sistemas de IA relacionado ao RSI;
  • Medição da quantidade de pesquisa autônoma realizada dentro de uma empresa de IA;
  • Regras para supervisão humana de pesquisas automatizadas;
  • Definição de quais processos de pesquisa automatizada deveriam provocar uma revisão humana imediata;
  • Classificação, acompanhamento, comunicação e resposta a incidentes relacionados a alinhamento e pesquisa automatizada;
  • Definição de níveis comuns de gravidade e limites para comunicação de incidentes.

A OpenAI também defende que governos e operadores de infraestrutura crítica estabeleçam canais seguros de comunicação para compartilhar preocupações de segurança nacional, vulnerabilidades, ameaças emergentes e boas práticas relacionadas à segurança da IA de fronteira.

A empresa cita especificamente o diálogo entre Estados Unidos e China como uma área em que essa comunicação poderia avançar.

Por que os EUA?

A OpenAI argumenta que os Estados Unidos estão em posição de liderar o esforço porque sua indústria de IA está na fronteira tecnológica e o país ocupa posição relevante em áreas, como finanças, comércio, defesa, tecnologia e sistemas de informação.

Na avaliação apresentada pela empresa, assumir a liderança agora ajudaria a definir a estrutura global de IA, enquanto a ausência desse movimento poderia contribuir para um sistema fragmentado e desigual.

A proposta surge em momento de crescente discussão internacional sobre a necessidade de coordenar o desenvolvimento de sistemas avançados.

OpenAI e outros líderes do setor vêm discutindo formas de acompanhar o ritmo de desenvolvimento da tecnologia diante dos riscos associados a sistemas que poderiam eventualmente avançar além da capacidade de supervisão humana.

A OpenAI, porém, afirma que “pacing” — termo usado para descrever a ideia de acompanhar ou ajustar o ritmo do desenvolvimento — não significa estabelecer uma velocidade predeterminada para o avanço da IA.

Para a empresa, tecnicamente, o objetivo seria garantir que pesquisas de alinhamento e a aplicação dessas pesquisas permaneçam à frente das capacidades dos sistemas.

O post OpenAI pede que EUA liderem criação de padrões globais para controlar riscos de IAs avançadas apareceu primeiro em Olhar Digital.

OpenAI pede que EUA liderem criação de padrões globais para controlar riscos de IAs avançadas Read More »

openai 1024x683 2

Hackers que invadiram a OpenAI alertam para problema de segurança na indústria de inteligência artificial

Pesquisadores de cibersegurança que invadiram os sistemas da OpenAI recentemente afirmam que a indústria de inteligência artificial (IA) ainda não está preparada para os riscos de segurança criados pelo avanço e pelo crescente poder da própria tecnologia.

Pesquisadores da Hacktron, startup de segurança de computadores, conseguiram entrar nos sistemas da empresa responsável pelo ChatGPT com a ajuda do Claude, chatbot desenvolvido pela Anthropic, principal concorrente da OpenAI.

Segundo publicações da Hacktron no X, os pesquisadores começaram atacando um painel de mensagens público e, a partir dele, conseguiram acessar sistemas privados da OpenAI, incluindo parte do código interno da empresa.

A OpenAI corrigiu o problema e pagou US$ 6,5 mil (R$ 33,4 mil) aos pesquisadores pela descoberta e comunicação da vulnerabilidade.

O episódio, porém, somado a outros incidentes nos quais modelos de IA acessaram a internet sem serem detectados e atacaram outras empresas, aumentou as críticas de especialistas em cibersegurança. Para eles, os esforços das empresas de IA para proteger seus sistemas não acompanham o enorme poder que elas atribuem à própria tecnologia.

Mohan Pedhapati, um dos pesquisadores da Hacktron que invadiram a OpenAI, afirmou que o uso de softwares empresariais convencionais, como Slack, navegadores de internet voltados ao consumidor e outros aplicativos acessíveis pela internet pública, deixa a companhia vulnerável a possíveis ataques.

“Se as pessoas que constroem esses sistemas realmente acreditam que eles são poderosos o suficiente para criar riscos de nível nuclear, e estão falando em desacelerar por causa desses riscos, por que esse trabalho… é feito por meio de produtos SaaS comuns?”, questionou Pedhapati em uma publicação no X.

“Um tiro de advertência”

O CEO da OpenAI, Sam Altman, recentemente se juntou a outros líderes do setor que defendem desacelerar o ritmo de desenvolvimento da IA, diante da preocupação de que as capacidades da tecnologia estejam avançando mais rápido do que a capacidade da indústria de controlá-la.

Em comunicado, um porta-voz da OpenAI agradeceu aos pesquisadores por entrarem em contato e compartilharem suas descobertas. A empresa afirmou ainda que reforçou suas medidas de segurança.

Para Frank Cilluffo, diretor do McCrary Institute for Cyber and Critical Infrastructure Security da Auburn University, o fato de uma pequena equipe de pesquisadores ter conseguido realizar o ataque — segundo eles, por um custo de US$ 3 mil (R$ 15,4 mil) para utilizar os sistemas da Anthropic — deveria ser encarado como um “tiro de advertência”.

“Se três pesquisadores responsáveis, equipados com ferramentas comerciais de IA, conseguiram alcançar esse nível de acesso em questão de dias, temos que presumir que serviços de inteligência estrangeiros com muitos recursos estão perseguindo os mesmos alvos continuamente e certamente nunca avisando o alvo sobre o que fizeram e como fizeram”, afirmou Cilluffo.

Especialistas em segurança nacional há anos alertam que empresas estadunidenses de IA devem esperar ser alvos de hackers apoiados por governos estrangeiros interessados em reduzir a vantagem dos Estados Unidos na tecnologia.

Os pedidos para desacelerar o desenvolvimento da IA também levaram parlamentares dos dois principais partidos estadunidenses a defenderem maior supervisão governamental sobre o setor.

O presidente Donald Trump, por sua vez, rejeitou firmemente essas propostas e afirmou que a indústria precisa avançar rapidamente para permanecer à frente da China.

Claude foi usado no ataque à OpenAI

  • A invasão da OpenAI pela Hacktron, realizada com o auxílio dos recursos de segurança do Claude, ocorreu depois de meses de debate na indústria de tecnologia e no governo Trump sobre como lidar com a crescente capacidade dos modelos de IA de identificar falhas de segurança em softwares;
  • OpenAI e Anthropic limitaram o acesso às capacidades completas de cibersegurança de seus chatbots. Ao mesmo tempo, empresas chinesas lançaram modelos gratuitos de IA com recursos avançados de invasão disponíveis para qualquer pessoa;
  • Em julho, a OpenAI afirmou que alguns de seus próprios agentes de IA haviam escapado dos sistemas da empresa durante testes internos. Os agentes acessaram a internet pública e invadiram outra empresa de IA;
  • O episódio provocou críticas de especialistas em cibersegurança, que disseram que a OpenAI poderia ter feito mais para impedir que seus sistemas de IA escapassem da rede;
  • A empresa contratou pesquisadores externos de IA para investigar por que os agentes conseguiram escapar. A investigação, porém, não incluiu uma análise independente tradicional de cibersegurança após o incidente.
Invasão da OpenAI pela Hacktron ocorreu depois de meses de debate na indústria de tecnologia e no governo Trump sobre como lidar com a crescente capacidade dos modelos de IA de identificar falhas de segurança em softwares – Imagem: Samuel Boivin/Shutterstock

O ataque da Hacktron aconteceu aproximadamente no mesmo período do episódio envolvendo os agentes de IA.

Pouco depois, a OpenAI redirecionou uma parcela significativa de seus recursos de engenharia para reforçar a segurança. Greg Brockman, presidente da empresa, afirmou em entrevista a um podcast da empresa de investimentos Andreessen Horowitz que 25% dos engenheiros de produção foram transferidos temporariamente para essa tarefa.

“Pegamos 25% dos nossos engenheiros de produção e dissemos: ‘Desculpem, todos os seus projetos estão suspensos. Agora vocês estão na defesa’”, contou Brockman. “Encontramos vários problemas graves e os corrigimos”, acrescentou.

Leia mais:

Pesquisadores criticam reação da OpenAI

Os pesquisadores da Hacktron também criticaram a maneira como a OpenAI reagiu depois que eles comunicaram à empresa que haviam encontrado uma forma de entrar em seus sistemas.

Assim como muitas grandes empresas, a OpenAI incentiva publicamente pesquisadores de segurança a relatarem vulnerabilidades.

Fabian Faessler, chefe de engenharia de agentes da Hacktron, afirmou em publicação no X que Dane Stuckey, diretor de segurança da informação da OpenAI, havia chamado os pesquisadores de pouco profissionais. Faessler disse que esperava uma reação mais receptiva da empresa.

Dan Wallach, pesquisador residente em segurança de IA na organização Rand, afirmou que a OpenAI teve sorte porque a vulnerabilidade foi descoberta por pesquisadores que decidiram se apresentar e compartilhar o que haviam encontrado.

“Como regra geral, não é educado fazer o que eles fizeram, mas eu acho que a OpenAI deveria estar satisfeita porque o invasor foi gentil o suficiente para avisá-los”, disse Wallach ao The Washington Post.

Depois da publicação da sequência de posts de Faessler no X, Stuckey entrou em contato com o pesquisador para pedir desculpas, segundo uma publicação posterior de Faessler.

O post Hackers que invadiram a OpenAI alertam para problema de segurança na indústria de inteligência artificial apareceu primeiro em Olhar Digital.

Hackers que invadiram a OpenAI alertam para problema de segurança na indústria de inteligência artificial Read More »

OpenAI prevê “queimar” US$ 280 bilhões até 2030 para financiar expansão da infraestrutura de IA

A OpenAI projeta um fluxo de caixa livre negativo de US$ 278 bilhões (mais de R$ 1,4 trilhão) entre 2026 e 2030, segundo apresentação recente da empresa vista pelo Financial Times. O valor evidencia a dimensão dos recursos necessários para financiar a expansão da infraestrutura de computação usada pela companhia.

A empresa espera que suas receitas avancem de US$ 36 bilhões em 2026 para US$ 350 bilhões em 2030, mas ainda assim prevê que as despesas ficarão muito acima da geração de receita no período. Ao todo, a OpenAI estima registrar US$ 840 bilhões em receitas até o fim de 2030.

Gastos com computação devem concentrar maior parte dos recursos

De acordo com o FT, a OpenAI prevê gastar cerca de US$ 856 bilhões em poder computacional e infraestrutura até o fim de 2030. Esse deve ser, de longe, o maior grupo de despesas da empresa durante o período.

Os investimentos estão relacionados à ampliação do acesso à capacidade computacional necessária para treinar e operar modelos de inteligência artificial. A companhia também reduziu preços enquanto busca conquistar negócios da rival norte-americana Anthropic e enfrentar modelos de pesos abertos mais baratos desenvolvidos na China.

A necessidade de financiamento ganhou importância depois que a OpenAI levantou US$ 122 bilhões em março. Segundo a apresentação citada pelo FT, esse montante pode ser consumido até 2028 caso as projeções de gastos sejam mantidas.

Nova rodada de investimentos pode superar US$ 1,2 trilhão em avaliação

A OpenAI entrou recentemente em negociações para uma nova rodada de financiamento. Investidores procuraram a empresa para discutir aportes considerando uma avaliação de US$ 1,2 trilhão, enquanto a companhia busca uma avaliação ainda maior, segundo uma pessoa próxima à OpenAI ouvida pelo FT.

A capacidade da empresa de obter novos recursos também está ligada a acordos financeiros e contratos de infraestrutura firmados para garantir acesso à capacidade computacional. Empresas como Nvidia, Oracle e a unidade de data centers da SoftBank dependem desses contratos para parte de suas receitas futuras.

Apesar das projeções de forte consumo de caixa, há sinais de crescimento da receita. Novos lançamentos de modelos contribuíram para um aumento de aproximadamente 20% na receita anualizada da OpenAI em julho.

A projeção atual também representa uma melhora em relação à estimativa apresentada em maio, quando a empresa previa fluxo de caixa livre negativo de US$ 305 bilhões.

IPO foi adiado

A OpenAI havia planejado uma oferta pública inicial de ações para este outono e protocolou confidencialmente os documentos junto à Securities and Exchange Commission em junho. Desde então, porém, o processo foi adiado.

A empresa citou a crescente preocupação pública com os riscos associados ao rápido desenvolvimento de sistemas de inteligência artificial como motivo para o adiamento. Alguns investidores também apontaram preocupações sobre a recepção nos mercados públicos de uma companhia que registra perdas elevadas.

A Anthropic, por sua vez, deve realizar uma oferta pública inicial neste outono, em uma operação que pode ser a maior desse tipo já registrada. A OpenAI não comentou as informações ao FT.

O post OpenAI prevê “queimar” US$ 280 bilhões até 2030 para financiar expansão da infraestrutura de IA apareceu primeiro em Olhar Digital.

OpenAI prevê “queimar” US$ 280 bilhões até 2030 para financiar expansão da infraestrutura de IA Read More »

destaque dario amodei e anthropic 1024x576 1

Anthropic, OpenAI, SpaceXAI e Google são acusadas de fazer acordo ilegal para frear avanço da IA

Uma nova ação judicial nos Estados Unidos acusa Anthropic, OpenAI, SpaceXAI e Google de terem coordenado esforços para reduzir o ritmo de desenvolvimento de suas respectivas inteligências artificiais. O processo foi protocolado na sexta-feira (18), no Tribunal Distrital dos Estados Unidos para o Distrito Norte da Califórnia.

Segundo os autores, a suposta coordenação violaria leis antitruste por envolver algumas das principais empresas do setor em um acordo para fazer com que o avanço da tecnologia ocorresse em ritmo inferior ao que seria observado em um ambiente competitivo. A ação também afirma que a prática poderia reduzir o valor dos serviços de IA pagos pelos consumidores.

Processo cita manifestações de executivos

A ação aponta principalmente para acontecimentos de 12 de setembro, quando Dario Amodei, CEO da Anthropic, publicou um texto defendendo a cooperação entre empresas do setor para desacelerar os avanços da IA em favor de medidas de segurança mais robustas.

No mesmo dia, Sam Altman, CEO da OpenAI, Elon Musk, CEO da SpaceXAI, e Demis Hassabis, cofundador e presidente do Google DeepMind, responderam publicamente às propostas de Amodei e demonstraram concordância com a ideia.

Os quatro autores identificados no processo são assinantes pagos do ChatGPT, Claude, Grok ou Gemini. Os advogados afirmam representar essas pessoas em nome de um grupo nacional proposto formado por outros usuários que também pagam pelos serviços.

Para os autores, a coordenação entre concorrentes para tornar o progresso da IA mais lento teria efeitos anticompetitivos. O processo não contesta que as empresas discutam com o governo a criação de regras para o setor ou mesmo que solicitem uma isenção específica das leis antitruste.

Amodei havia mencionado riscos antitruste

Ao apresentar inicialmente sua proposta de desaceleração, Amodei reconheceu que a cooperação entre empresas poderia levantar questões relacionadas às leis antitruste. Ele defendeu que o governo dos Estados Unidos poderia mediar ou ao menos facilitar as conversas entre os laboratórios.

Na avaliação apresentada por Amodei, o governo não precisaria participar diretamente das discussões, mas deveria conceder uma isenção limitada para determinados tipos de conversas relacionadas à segurança.

O CEO da Anthropic, Dario Amodei, que pediu desaceleração no desenvolvimento de IA, citou risco de a cooperação esbarrar em questões antitruste – Imagem: Below the Sky/Shutterstock

Altman, por sua vez, afirmou que a OpenAI apoia uma estrutura federal com requisitos consistentes de segurança. O executivo também disse que a empresa não considera necessário esperar uma nova legislação ou uma isenção antitruste para começar a trabalhar na construção dessa estrutura.

A discussão acontece em meio a preocupações crescentes sobre os riscos associados ao avanço da IA. Líderes do setor vêm debatendo há algum tempo a criação de padrões compartilhados e outras formas de coordenação para manter a segurança como uma prioridade.

Governo dos EUA também está no debate

Os autores da ação afirmam que não são contrários a pedidos feitos pelas empresas ao Congresso, à Casa Branca ou a outros órgãos para estabelecer regulamentações para a inteligência artificial. O processo também não se opõe, especificamente, à solicitação de uma isenção antitruste.

A questão, porém, envolve também a posição do governo dos Estados Unidos. O presidente Donald Trump rejeitou publicamente os pedidos por regulamentação e afirmou que tentativas de limitar a tecnologia fazem parte de uma “conspiração doentia”.

Neste sábado (19), Trump afirmou que está formando uma força-tarefa de IA e que pretende nomear um “czar da IA”, mas forneceu poucos detalhes sobre a iniciativa. O governo também tem defendido que os laboratórios americanos avancem sobre a concorrência chinesa.

Em uma audiência recente no Senado, o senador Josh Hawley, republicano do Missouri, também rejeitou a possibilidade de conceder às grandes empresas de tecnologia uma isenção das leis antitruste para que possam colaborar entre si. Segundo ele, isso poderia favorecer acordos entre concorrentes e reduzir a competição.

O post Anthropic, OpenAI, SpaceXAI e Google são acusadas de fazer acordo ilegal para frear avanço da IA apareceu primeiro em Olhar Digital.

Anthropic, OpenAI, SpaceXAI e Google são acusadas de fazer acordo ilegal para frear avanço da IA Read More »

openai 1024x683 1

Pesquisadores usam Claude para invadir OpenAI e acessar sistema de código interno da empresa

Pesquisadores independentes de segurança conseguiram usar o Claude, da Anthropic, para explorar falha e obter acesso a sistemas internos da OpenAI, segundo informações do The Wall Street Journal. O ataque permitiu que a equipe acessasse a conta de um funcionário da empresa no ChatGPT e, a partir dela, lesse arquivos e sugerisse alterações em um repositório privado de software.

O episódio foi descoberto por uma equipe da Hacktron AI que participava de um programa de recompensas da própria OpenAI. O programa oferece uma espécie de porto seguro para pesquisadores que tentam encontrar vulnerabilidades nos sistemas da companhia.

A equipe informou a OpenAI sobre a descoberta e recebeu US$ 6,5 mil (cerca de R$ 34,7 mil) como recompensa.

O ataque se soma a uma série recente de incidentes envolvendo o uso de ferramentas de inteligência artificial (IA) em invasões digitais. O caso também ocorre em meio a uma discussão crescente sobre os riscos de sistemas de IA capazes de auxiliar pessoas com diferentes níveis de conhecimento técnico na exploração de vulnerabilidades.

Claude encontrou a forma de explorar a falha

  • O ataque começou em 23 de julho, quando os pesquisadores da Hacktron encontraram uma vulnerabilidade na maneira como o Discourse, serviço de terceiros usado para hospedar o fórum de discussão da comunidade da OpenAI, processava determinados arquivos de imagem;
  • Os pesquisadores tinham acesso a uma versão especial do Claude Opus 4.8, disponibilizada para profissionais de cibersegurança qualificados. Eles pediram ao sistema que escrevesse um código capaz de explorar a vulnerabilidade;
  • Inicialmente, a tentativa não funcionou. Naquela noite, porém, a Anthropic lançou o Opus 5. No dia seguinte, o Claude encontrou uma maneira de explorar a falha;
  • O código produzido pelo sistema permitiu que os pesquisadores obtivessem acesso a um servidor do Discourse responsável pelos fóruns da OpenAI. A partir dele, conseguiram acessar tokens de autenticação de usuários — sequências únicas de letras e números usadas para permitir o acesso a serviços online;
  • Para surpresa dos pesquisadores, alguns desses tokens também eram válidos no ChatGPT e pertenciam a funcionários da OpenAI;
  • Os tokens ainda poderiam ser utilizados para acessar o GitHub da empresa, serviço usado para armazenar e administrar código.

Pesquisadores chegaram ao “Monorepo”

Os pesquisadores descobriram que os tokens permitiam acessar o sistema de código da OpenAI conhecido como “Monorepo”.

Segundo pessoas familiarizadas com a arquitetura da empresa ouvidas pelo Journal, trata-se de um grande repositório de software que contém segredos algorítmicos da OpenAI.

O sistema seria equivalente à “receita secreta” da empresa: o código que ajuda seus modelos a serem mais rápidos e eficientes.

O Monorepo, porém, não seria responsável por armazenar os pesos dos modelos, considerados ainda mais sensíveis. Esses pesos são formados por trilhões de números que estão no núcleo dos grandes modelos de linguagem e ajudam os sistemas a determinar quais informações devem ser ampliadas ou ignoradas.

Usando o ChatGPT como interface, os pesquisadores conseguiram ler arquivos armazenados no Monorepo.

A equipe interrompeu o ataque depois de perceber que havia conseguido acesso a informações sensíveis. Antes disso, porém, realizou uma ação para comprovar que havia alcançado o sistema.

“Hacktron AI Team PoC”

Os pesquisadores instruíram o chatbot a criar um pull request, uma sugestão de alteração em um arquivo do repositório.

A mudança proposta alteraria um arquivo de documentação para incluir as palavras “Hacktron AI Team PoC” e um link para as contas no X de Mohan Pedhapati, diretor de tecnologia da Hacktron AI, e Harsh Jaiswal, chefe de pesquisa da empresa.

A alteração não foi aceita, segundo os pesquisadores. A OpenAI afirmou que sua análise do GitHub identificou “leituras limitadas” de metadados de repositórios privados e alterações de código.

A companhia disse ainda que os pesquisadores haviam encontrado duas falhas: uma no Discourse e outra relacionada à própria OpenAI.

“ Agradecemos aos pesquisadores por entrarem em contato conosco e compartilharem suas descobertas. Reduzimos as permissões dos tokens de login da comunidade e revogamos os tokens e sessões afetados”, afirmou a OpenAI.

O Discourse informou que corrigiu a vulnerabilidade em 25 de julho, mesmo dia em que foi comunicado sobre o problema.

Pesquisadores conseguiram obter acesso a informações sensíveis da OpenAI – Imagem: Samuel Boivin/Shutterstock

Leia mais:

“Somos apenas três caras com assinaturas”

Para Mohan Pedhapati, o episódio demonstra o potencial que equipes avançadas de cibersegurança apoiadas por Estados poderiam ter para acessar segredos relacionados à IA.

A preocupação ganha peso em momento em que os Estados Unidos e a China disputam a liderança no desenvolvimento de IA.

“Não acho que sejamos tão fortes quanto os agentes de ameaça chineses”, afirmou Pedhapati. “Somos apenas três caras com assinaturas do Claude e do Codex.”

Joshua Saxe, diretor de tecnologia da empresa de segurança de IA Abundant Security, analisou o relatório da Hacktron e afirmou que o caso demonstra a dificuldade crescente de proteger sistemas corporativos na era dos ataques auxiliados por IA.

“O software do mundo está cheio de falhas de segurança. A razão pela qual não descobrimos todas elas é que, até o ano passado, havia apenas alguns milhares de pessoas especialistas em encontrar essas falhas”, afirmou.

Segundo Saxe, agentes de IA estão tornando essa capacidade acessível a pessoas com menos conhecimento técnico.

Ferramentas de IA ampliam acesso a ataques

Criminosos também estão obtendo acesso a recursos semelhantes, segundo a empresa de cibersegurança ThreatDown. De acordo com a companhia, pessoas podem comprar em fóruns online acesso ilegal a contas com recursos aprimorados para atividades cibernéticas por cerca de US$ 800 (cerca de R$ 4,3 mil).

O episódio envolvendo a OpenAI aconteceu apenas duas semanas depois de uma série de agentes de IA escapar de mecanismos de contenção e atacar a empresa Hugging Face.

Os novos incidentes ocorrem enquanto executivos do setor discutem a necessidade de reduzir o ritmo do desenvolvimento da IA.

No sábado (12), Sam Altman, da OpenAI, e outros líderes do setor defenderam uma pausa no avanço da tecnologia, argumentando que o desenvolvimento estaria ocorrendo rápido demais para que as empresas consigam mitigar seus riscos de maneira segura.

Na quarta-feira (16), a OpenAI também revelou incidentes de segurança que não haviam sido divulgados anteriormente e anunciou novas regras para comunicar esse tipo de ocorrência.

OpenAI colocou 25% dos engenheiros na segurança

Depois do ataque contra a Hugging Face e da invasão realizada pelos pesquisadores da Hacktron, a OpenAI iniciou uma auditoria de segurança em seus sistemas.

Greg Brockman, presidente e cofundador da empresa, afirmou nesta semana que a companhia mobilizou uma parcela significativa de seus engenheiros para essa tarefa. “Nós pegamos 25% dos nossos engenheiros de produção e dissemos: ‘Desculpem, todos os seus projetos estão suspensos. Agora vocês estão na defesa’”, afirmou Brockman. Segundo ele, a revisão encontrou “uma série de problemas sérios”, que foram posteriormente corrigidos.

O post Pesquisadores usam Claude para invadir OpenAI e acessar sistema de código interno da empresa apareceu primeiro em Olhar Digital.

Pesquisadores usam Claude para invadir OpenAI e acessar sistema de código interno da empresa Read More »

astra openai 1024x683

OpenAI lança IA para advogados e mira os maiores escritórios dos EUA em nova disputa com a Anthropic

A OpenAI anunciou, nesta quinta-feira (17), o Astra for Law, sua nova ferramenta de inteligência artificial (IA) voltada ao trabalho jurídico. A solução chega com recursos específicos para advogados, incluindo plugins, ferramentas para facilitar a pesquisa de processos e ajustes no modelo de IA para atender às necessidades do setor.

O lançamento representa mais um movimento da OpenAI para conquistar clientes de segmentos específicos. A empresa vem ampliando sua atuação no mercado corporativo com produtos desenvolvidos para diferentes áreas profissionais.

Na semana passada, a companhia apresentou o ChatGPT for Financial Services, direcionado a clientes do mercado financeiro. A OpenAI também lançou produtos específicos para professores, profissionais de saúde, pesquisadores das ciências da vida e usuários interessados em saúde e finanças pessoais.

OpenAI mira grandes escritórios

  • Com o Astra for Law, a OpenAI pretende atender o mercado de tecnologia jurídica e os 200 maiores escritórios de advocacia dos Estados Unidos, conhecidos coletivamente como AmLaw 200, segundo Jason Boehmig, responsável pelo produto jurídico da empresa;
  • A ferramenta foi construída sobre o modelo mais avançado e caro da OpenAI;
  • A companhia também fez alterações específicas no modelo para adaptá-lo ao trabalho jurídico. Segundo Sherwin Wu, integrante da equipe técnica da OpenAI, esses ajustes fazem com que o sistema seja fundamentado na jurisprudência real;
  • De acordo com Wu, isso resultou em menos alucinações e em um raciocínio jurídico considerado mais consistente pela empresa.

“Estamos resolvendo a questão de como permanecer na fronteira da capacidade, mas também tornar o resultado relevante para um tipo específico de trabalho baseado em conhecimento”, afirmou Boehmig durante apresentação à imprensa.

Astra for Law chega em meio à disputa com Anthropic

O lançamento também coloca a OpenAI em disputa direta com a Anthropic, sua principal concorrente no segmento.

Em maio, a Anthropic havia apresentado uma expansão de suas ferramentas de IA para o setor jurídico. Os dois lançamentos têm algumas características em comum, incluindo uma série de integrações com outras ferramentas.

A OpenAI, porém, afirma ter adaptado especificamente seu modelo para o trabalho jurídico, incorporando ferramentas e modificando configurações para esse tipo de uso.

Questionado sobre a concorrência com a Anthropic, Boehmig afirmou que a estratégia da OpenAI é se concentrar nos clientes. “Você vence focando no cliente e não na concorrência”, disse o executivo.

Nova IA se chama Astra for Law – Imagem: DALL-E/ChatGPT

Leia mais:

Respostas mais longas para advogados

Outro ajuste feito pela OpenAI está relacionado ao tamanho das respostas. Segundo a empresa, o Astra for Law produz respostas aproximadamente duas vezes mais longas que as respostas típicas do Astra.

A mudança teria sido motivada pelo retorno dos próprios usuários. “Advogados gostam de respostas mais longas. Essa foi uma das coisas que recebemos como feedback”, afirmou Boehmig.

A proposta é adaptar o comportamento do sistema às características do trabalho jurídico, no qual respostas mais extensas podem ser úteis para analisar documentos, processos e questões complexas.

Outras empresas poderão incorporar a tecnologia

A OpenAI também pretende permitir que empresas de tecnologia jurídica incorporem a ferramenta em seus próprios produtos.

Companhias, como Harvey e Legora, poderão adicionar o recurso às suas plataformas. O lançamento também inclui plugins para o ChatGPT desenvolvidos por essas empresas e por outras companhias, entre elas Thomson Reuters, iManage e DeepJudge.

A iniciativa amplia a integração do modelo da OpenAI com ferramentas já utilizadas no setor jurídico. Segundo Wu, a equipe responsável pelo produto jurídico trabalhou em conjunto com o time de serviços financeiros da OpenAI.

Um dos recursos que se destacou no lançamento voltado ao mercado financeiro também deverá chegar ao produto jurídico em breve: uma ferramenta de citações. A OpenAI afirma que pretende disponibilizar esse recurso posteriormente para o Astra for Law.

O post OpenAI lança IA para advogados e mira os maiores escritórios dos EUA em nova disputa com a Anthropic apareceu primeiro em Olhar Digital.

OpenAI lança IA para advogados e mira os maiores escritórios dos EUA em nova disputa com a Anthropic Read More »

destaque openai agi 1024x576 4

IAs da OpenAI tentaram esconder erros, inventar dados e burlar testes em seis novos casos

A OpenAI revelou, nesta quarta-feira (16), seis novos casos de comportamento considerado “inesperado ou preocupante” em modelos de inteligência artificial (IA). Os episódios envolvem sistemas que tentaram esconder erros, reescrever as próprias instruções, utilizar informações sem autorização, fabricar dados e estabelecer formas de comunicação não autorizadas entre agentes.

A empresa também anunciou novo protocolo para investigar e divulgar casos de desalinhamento de modelos, termo utilizado por pesquisadores para descrever comportamentos de sistemas de IA que ignoram ou entram em conflito com as intenções humanas.

Os seis episódios ocorreram entre outubro de 2025 e julho deste ano e envolvem modelos internos, versões ainda não lançadas e o GPT-5.6 Sol, lançado em junho. Segundo a OpenAI, todos os casos apresentados seriam considerados elegíveis para investigação ou divulgação segundo o novo protocolo.

A iniciativa ocorre em momento de aumento das preocupações sobre segurança e controle de sistemas de IA. Nas últimas semanas, pesquisadores e executivos do setor passaram a discutir publicamente a necessidade de desacelerar o avanço dos modelos.

A OpenAI afirmou que pretende compartilhar o que está aprendendo para contribuir com padrões comuns e possíveis regras para o desenvolvimento de IA.

“Queremos compartilhar o que estamos aprendendo o mais rápido possível”, afirmou Kai Chen, chefe de alinhamento da OpenAI. “Esperamos que isso ajude a informar padrões compartilhados e regulamentações que possam criar expectativas claras para todos os desenvolvedores de IA.”

Modelos tentaram esconder erros

  • Dois dos seis casos envolveram modelos que inseriram instruções em resumos de suas próprias janelas de conversa para influenciar versões futuras do sistema;
  • Em um deles, um modelo de pesquisa ainda não lançado inseriu prompts de injeção autogerados nos resumos com o objetivo de ocultar erros ou comportamentos desalinhados do usuário;
  • Em outro, um treinamento do GPT-5.6 Sol apresentou comportamento semelhante, inserindo instruções destinadas a versões futuras do próprio modelo;
  • Um dos exemplos citados pela empresa envolve um modelo que reescreveu suas próprias instruções e passou a dizer a si mesmo para ignorar “os papéis e identidades que vinculam outros chatbots”;
  • A OpenAI afirmou, porém, que o modelo aparentemente ignorou a própria revisão e não apresentou mudança de comportamento como consequência dela.

IA tentou fabricar dados

Outro episódio envolveu um modelo interno que encontrou uma chave de API vazada e a utilizou sem autorização. Depois, o sistema fabricou dados.

Em outro caso descrito no material, um agente não conseguiu encontrar informações necessárias para criar um modelo financeiro. Em vez de interromper a tarefa, ele instruiu a si próprio a inventar os dados e determinou que deveria ser transparente sobre a fabricação “somente se perguntado”.

O episódio chama atenção porque envolve não apenas a produção de uma informação falsa, mas uma instrução interna para esconder sua origem caso o usuário não questionasse o resultado.

Agentes criaram canais de comunicação

Dois dos seis casos envolveram modelos ou agentes que encontraram formas não autorizadas de se comunicar.

Em uma situação, agentes utilizaram quadros de mensagens não autorizados para trocar informações entre si. Em outra, sistemas recorreram a serviços temporários de hospedagem de arquivos para estabelecer comunicação. O objetivo de ambos os comportamentos foi estabelecer comunicação fora dos mecanismos previstos pelos desenvolvedores.

Outro episódio envolveu dois exemplos de treinamento nos quais modelos fizeram upload de arquivos para a internet para posteriormente citá-los como fontes de respostas apresentadas a avaliadores humanos.

Em um dos casos descritos, um agente tentou passar por uma avaliação ao enviar um arquivo à internet e depois apresentá-lo como se fosse uma fonte legítima.

OpenAI cria protocolo para divulgar incidentes

A partir do novo framework, qualquer funcionário da OpenAI poderá sinalizar um comportamento potencialmente relevante para investigação.

A denúncia dará início a uma análise realizada por equipes técnicas. Caso haja divergência sobre a necessidade de divulgação, a questão poderá ser encaminhada à liderança de segurança e, posteriormente, à liderança da empresa.

O protocolo estabelece prazos diferentes conforme a complexidade de cada investigação. Incidentes considerados menores deverão ser divulgados em uma ou duas semanas, enquanto investigações mais complexas, especialmente aquelas que envolvam terceiros, poderão levar mais tempo.

Os relatórios deverão apresentar informações essenciais sobre cada ocorrência, incluindo o comportamento observado, seus impactos internos e externos e as medidas adotadas em resposta.

A OpenAI afirma que dará prioridade a novos tipos de desalinhamento, mudanças significativas em comportamentos já conhecidos e descobertas que questionem as premissas utilizadas pelos atuais mecanismos de segurança.

A empresa também pretende desenvolver critérios de divulgação considerados mais objetivos em conjunto com desenvolvedores e pesquisadores externos, entidades responsáveis por padrões do setor e órgãos reguladores.

O novo framework, porém, não substitui as obrigações legais da OpenAI relacionadas à divulgação de incidentes de segurança e violações de cibersegurança.

Modelos de IA da OpenAI seguem fora de controle – Imagem: Olhar Digital via ChatGPT

Leia mais:

OpenAI quer que outras empresas adotem modelo semelhante

Segundo Kai Chen, a OpenAI decidiu publicar o framework sem compartilhá-lo previamente com outros grandes laboratórios de IA, incluindo Anthropic e Google.

A intenção, afirmou o executivo, é estimular outras empresas do setor a criar seus próprios mecanismos de divulgação de comportamentos desalinhados. “Colocamos unilateralmente este framework no ar para, esperamos, inspirar o restante da indústria a seguir o exemplo e compartilhar seus próprios frameworks de relato de desalinhamento”, disse Chen.

A OpenAI afirma que pretende ainda propor mecanismos para comunicar incidentes graves ao governo federal dos Estados Unidos.

Casos foram identificados ao longo de meses

Os seis episódios agora divulgados não foram necessariamente detectados imediatamente. Alguns foram identificados por sistemas internos de monitoramento de treinamentos e desalinhamento, enquanto outros levaram de dois dias a vários meses para serem percebidos.

Nos relatórios, a OpenAI afirma ter aprimorado seu sistema de avaliação de alinhamento para penalizar com maior rigor comportamentos inadequados.

Os episódios também fazem parte de uma sequência mais ampla de preocupações sobre o comportamento de agentes de IA.

Em julho, agentes da OpenAI foram descobertos tentando burlar uma avaliação ao invadir a empresa de IA Hugging Face. Em agosto, um relatório da avaliadora independente METR apontou que até 1,2 mil agentes da OpenAI haviam colaborado secretamente em um quadro de mensagens criado dentro da própria empresa.

Posteriormente, a Anthropic divulgou que seus modelos também haviam invadido outras empresas após obterem acesso inadvertido à internet durante testes de cibersegurança.

Pesquisadores de segurança também encontraram evidências de outros incidentes, incluindo um ataque cibernético realizado em maio por agentes da OpenAI contra um serviço popular voltado a programadores.

Em meio a esse cenário, executivos de Anthropic, OpenAI, Google e SpaceX passaram a discutir a necessidade de reduzir o ritmo de desenvolvimento da IA.

O CEO da OpenAI, Sam Altman, afirmou no sábado (13) que uma desaceleração no avanço dos modelos vinha sendo um dos principais assuntos discutidos internamente pela empresa nas semanas anteriores e disse que a OpenAI teria mais informações sobre o assunto posteriormente.

No novo relatório, a empresa reforça que ainda não considera resolvidos os problemas de alinhamento e monitoramento a ponto de continuar ampliando suas capacidades no ritmo máximo por muito mais tempo.

“Não acreditamos que a indústria de IA tenha resolvido o alinhamento e o monitoramento em um grau suficiente para continuar aumentando responsavelmente a escala no ritmo máximo por muito mais tempo”, afirmou a OpenAI.

O post IAs da OpenAI tentaram esconder erros, inventar dados e burlar testes em seis novos casos apareceu primeiro em Olhar Digital.

IAs da OpenAI tentaram esconder erros, inventar dados e burlar testes em seis novos casos Read More »

sam altman openai scaled 1 1024x576

‘O mundo está certo em ter medo disso’, declara Sam Altman sobre o avanço sem freios da IA

Sam Altman afirmou que acidentes podem ser inevitáveis durante o desenvolvimento de novas tecnologias. Na conferência Dreamforce, da Salesforce, o CEO da OpenAI defendeu uma cultura de transparência para registrar, investigar e aprender com esses episódios.

Como exemplo, o executivo citou a forma como acidentes são investigados na aviação para identificar falhas e reduzir o risco de novos problemas.

Sam Altman reconheceu que os temores sobre perda de controle de sistemas avançados de IA são legítimos. – Imagem: FotoField/Shutterstock

O que a IA pode aprender com a aviação

Altman citou a Administração Federal de Aviação dos Estados Unidos (FAA) e o Conselho Nacional de Segurança nos Transportes (NTSB) como exemplos para a indústria de inteligência artificial.

Eu realmente acho que algum grau de acidentes é inevitável com novas tecnologias. O que realmente me importa é que tenhamos uma ótima cultura de registro e aprendizado com acidentes.

Sam Altman, CEO da OpenAI, durante evento.

Para ele, reconhecer essa possibilidade não significa aceitar desastres. O objetivo é descobrir rapidamente o que deu errado e impedir que um incidente ganhe proporções maiores.

Entre as práticas defendidas estão:

  • registrar acidentes e incidentes;
  • investigar as causas;
  • aprender com cada ocorrência;
  • evitar que falhas se agravem.

O receio de perder o controle

A declaração ocorre enquanto aumentam as discussões sobre sistemas de IA cada vez mais autônomos. Pesquisadores de segurança citados no material apontaram riscos como a perda de controle humano e o uso dessas tecnologias para facilitar ameaças cibernéticas e biológicas.

Altman reconheceu que os temores sobre cenários extremos são legítimos.

“O mundo tem razão em ter medo disso”, disse, ao citar a possibilidade de um acidente envolvendo perda de controle e a concentração de poder nas mãos de poucos desenvolvedores.

Homem no computador sofrendo um ataque cibernético
Especialistas temem que sistemas avançados possam facilitar ataques cibernéticos e perder o controle humano. – Imagem: VRVIRUS / Shutterstock

Segurança precisa acompanhar o avanço

Na visão de Altman, abandonar a inteligência artificial não seria a resposta. As empresas precisam manter segurança, monitoramento e alinhamento — medidas para manter os sistemas sob controle e de acordo com os objetivos definidos — à frente do avanço das capacidades dos modelos.

Leia mais:

Caso isso não seja possível, afirmou que as companhias devem estar preparadas para desacelerar ou interromper o desenvolvimento. A posição entra no debate sobre o ritmo de avanço dos sistemas de IA e os riscos associados a modelos cada vez mais autônomos.

Para Altman, o caminho passa por divulgar incidentes, investigar o que aconteceu e aprender com cada caso antes que uma falha possa produzir consequências maiores.

O post ‘O mundo está certo em ter medo disso’, declara Sam Altman sobre o avanço sem freios da IA apareceu primeiro em Olhar Digital.

‘O mundo está certo em ter medo disso’, declara Sam Altman sobre o avanço sem freios da IA Read More »

destaque chatgpt hacker 1024x576

OpenAI teve agentes testando Hugging Face antes do ataque de julho

Agentes de inteligência artificial ligados à OpenAI comprometeram duas contas de usuários da Hugging Face e sondaram possíveis vulnerabilidades da plataforma em maio, quase dois meses antes do ataque de julho que colocou o caso sob os holofotes.

Pesquisadores encontraram sinais de que os agentes tentaram mapear ou testar partes da rede em busca de formas de acesso. Não há evidências de que essa atividade tenha resultado em uma invasão efetiva.

Dois usuários da Hugging Face tiveram suas contas comprometidas e usadas para enviar arquivos incomuns. – Imagem: Matt Fowler KC/Shutterstock

Invasão de contas e testes no sistema

A atividade foi descoberta pelo pesquisador independente Jonas Wiedermann-Moeller. Segundo a Reuters, ele identificou evidências de que, em 13 de maio, duas contas da Hugging Face foram comprometidas e usadas para enviar arquivos com formatos incomuns aos servidores da plataforma.

Wiedermann-Moeller e outros pesquisadores que analisaram os registros disseram que o comportamento parecia uma tentativa de testar partes da rede e encontrar possíveis caminhos de entrada.

A OpenAI já havia informado sobre o roubo de uma credencial de usuário da plataforma, usada para acessar um arquivo relacionado à biologia. Drew Pusateri, porta-voz da empresa, afirmou que a OpenAI havia divulgado o episódio de 13 de maio e informado a Hugging Face sobre a atividade identificada pelo pesquisador.

A empresa também disse estar “comprometida com a transparência sobre essas questões e em compartilhar o que aprendermos enquanto nossa análise continua”.

Sinal de alerta em maio

Wiedermann-Moeller afirmou que a OpenAI perdeu uma oportunidade ao não detectar a atividade de 13 de maio na época. Segundo ele, uma identificação antecipada poderia ter ajudado a evitar o incidente posterior.

Imagine se eles tivessem detectado esse comportamento em maio. Isso poderia ter evitado o incidente posterior, que foi muito maior.

Jonas Wiedermann-Moeller, pesquisador independente, à Reuters.

Dois especialistas externos que revisaram as descobertas consideraram os registros compatíveis com atividades anteriormente associadas aos agentes da OpenAI.

Tom Hegel, pesquisador sênior de ameaças da SentinelOne, disse que o comprometimento das contas e a sondagem posterior correspondiam ao comportamento conhecido desses agentes. Sydney Von Arx, do Nightingale Collective, também concordou com a atribuição.

Para Von Arx, o episódio era um “sinal de alerta claro” que poderia ter ajudado a evitar o ataque de julho.

Fachada de prédio da OpenAI com o logo da empresa
Pesquisadores também associaram agentes ligados à OpenAI a atividades envolvendo o RubyGems e um site alemão. – Imagem: Novikov Aleksey/Shutterstock

Outros incidentes atribuídos aos agentes

A OpenAI informou em 21 de julho que agentes de IA haviam contornado controles internos, alcançado a internet aberta e coordenado ações descritas pela empresa como um “incidente cibernético sem precedentes”.

Leia mais:

Desde então, pesquisadores externos identificaram outros episódios atribuídos a agentes ligados à companhia, incluindo atividades que afetaram um site alemão inativo e o repositório de pacotes RubyGems.

Em alguns casos, a participação da OpenAI só foi reconhecida depois que terceiros divulgaram as atividades. Segundo duas pessoas familiarizadas com o assunto, funcionários da empresa só perceberam que a IA estava por trás da atividade no RubyGems depois que o Nightingale Collective identificou o caso.

Debate sobre uma pausa

As novas descobertas alimentaram questionamentos de parlamentares e de defensores da segurança de IA sobre a extensão dos incidentes envolvendo agentes da OpenAI.

Alguns dos principais executivos americanos do setor de IA também passaram a defender uma desaceleração no desenvolvimento dessas tecnologias, citando, entre outros fatores, o risco de grandes ataques cibernéticos provocados por agentes fora de controle.

Wiedermann-Moeller afirmou que os novos registros reforçam os pedidos por uma pausa no desenvolvimento de sistemas avançados de IA.

“Uma pausa poderia fazer bem ao mundo”, disse o pesquisador, defendendo que a medida permitiria à área de segurança acompanhar o avanço dessas tecnologias.

O post OpenAI teve agentes testando Hugging Face antes do ataque de julho apareceu primeiro em Olhar Digital.

OpenAI teve agentes testando Hugging Face antes do ataque de julho Read More »