Gemini

Auto Added by WPeMatico

gemini invasao 2 1024x683

Gemini invade sistemas de três empresas reais durante teste de segurança do Google

O Gemini, modelo de inteligência artificial (IA) do Google, acessou a internet e invadiu os sistemas de três empresas durante um teste de suas capacidades de cibersegurança. O episódio é o primeiro caso conhecido em que um sistema de IA do Google realizou autonomamente uma invasão desse tipo.

As invasões aconteceram em maio, durante exercício de segurança conduzido pela Irregular, empresa independente especializada em avaliações de cibersegurança. O caso foi confirmado pelo Google nesta sexta-feira (18).

Em um dos episódios, o Gemini conseguiu acesso a um sistema protegido depois de tentar adivinhar senhas. Nos outros dois, o modelo encontrou credenciais em repositórios públicos na internet e utilizou os dados para acessar sistemas protegidos.

Em todos os casos, segundo o Google, o Gemini interrompeu a ação depois de perceber que havia acessado sistemas de empresas reais.

A Irregular informou ao Google sobre os incidentes no fim de julho, após a descoberta de outro episódio envolvendo modelos da OpenAI e a empresa de software de IA Hugging Face.

IA deveria estar isolada da internet

  • Os ataques ocorreram durante um exercício de capture the flag realizado na infraestrutura da Irregular. O Gemini recebeu a tarefa de obter informações de um software operado por uma empresa fictícia dentro do ambiente de testes;
  • O problema é que a empresa fictícia utilizada na simulação tinha o mesmo nome de uma empresa real;
  • Além disso, embora o modelo não devesse ter acesso à internet, essa conexão foi disponibilizada acidentalmente durante o teste;
  • No primeiro caso, o Gemini encontrou uma senha que permitiu entrar no serviço da empresa real. Depois de identificar que o alvo não fazia parte da simulação, o modelo interrompeu a ação e deixou o sistema;
  • Nas outras duas execuções, o Gemini realizou buscas na internet pelo nome da empresa fictícia. As pesquisas levaram o modelo a dois repositórios públicos diferentes que continham credenciais pertencentes a outras empresas;
  • O modelo tentou utilizar essas credenciais para concluir a avaliação. Depois de conseguir acesso aos sistemas, porém, identificou que se tratava de empresas reais e interrompeu a atividade;
  • A Reuters confirmou que os três casos ocorreram durante o teste da Irregular e que, em dois deles, o Gemini encontrou credenciais em repositórios públicos para acessar sistemas protegidos.

Google não considera caso de “desalinhamento”

Apesar das invasões, o Google afirmou que não considera o episódio um exemplo de desalinhamento de modelo, conceito utilizado para descrever situações em que uma IA age de maneira contrária às intenções ou aos valores humanos estabelecidos.

Segundo a empresa, as próprias medidas de segurança do Gemini fizeram com que o modelo interrompesse as ações assim que percebeu que havia acessado sistemas reais.

O Google comparou o episódio a um programa de bug bounty, no qual pesquisadores e hackers recebem autorização ou recompensa para encontrar vulnerabilidades e comunicá-las aos responsáveis.

Heather Adkins, vice-presidente de engenharia de segurança do Google, afirmou que o episódio “destaca a importância de treinar modelos de IA poderosos para agir de maneira responsável”. Segundo ela, “neste caso, o modelo agiu adequadamente”.

Em um dos episódios, o Gemini conseguiu acesso a um sistema protegido depois de tentar adivinhar senhas: nos outros dois, o modelo encontrou credenciais em repositórios públicos na internet e utilizou os dados para acessar sistemas protegidos – Imagem: gerada por IA – ChatGPT/Olhar Digital

A interpretação, porém, é contestada por especialistas em segurança.

Jack Cable, CEO da startup de segurança de IA Corridor e hacker de white hat, afirmou que a questão principal não seria o nível de dano provocado, mas o fato de o agente de IA ter invadido acidentalmente sistemas pertencentes a outras empresas.

Para Cable, a discussão sobre o incidente deveria se concentrar no fato de que modelos estão ultrapassando os limites para os quais foram projetados e realizando ataques cibernéticos reais.

Leia mais:

Google demorou para divulgar o caso

A Irregular comunicou os incidentes ao Google no fim de julho, mas a empresa não havia divulgado publicamente os episódios até que o The Wall Street Journal questionasse a companhia sobre o assunto nesta semana.

A empresa afirmou que não considerou necessário divulgar os casos porque o Gemini não causou danos às companhias e encerrou as invasões assim que percebeu que havia acessado sistemas reais.

As três empresas afetadas foram notificadas, mas o Google não revelou seus nomes. A companhia também informou as autoridades federais dos Estados Unidos sobre os incidentes.

O Google afirmou ainda que o episódio não envolveu seu modelo mais recente, mas não revelou qual versão do Gemini foi responsável pelas invasões.

A Irregular afirmou que o caso envolve o mesmo problema observado em outros laboratórios de IA e que todas as empresas relevantes foram notificadas no fim de julho. A companhia também disse que tomou medidas imediatas e que todos os problemas conhecidos de sua responsabilidade foram corrigidos semanas atrás.

Outros modelos também escaparam dos testes

O episódio envolvendo o Gemini não foi isolado. A própria Irregular participou de avaliações que acabaram envolvendo modelos de outras empresas em situações semelhantes.

Incidentes relacionados foram divulgados anteriormente por Meta, Anthropic e OpenAI. Esses episódios levantaram questionamentos sobre quais mecanismos de segurança são necessários à medida que agentes de IA ganham maior autonomia e acesso à internet e a sistemas computacionais.

O comportamento também apresentou diferenças entre os modelos.

Segundo a Anthropic, o Claude Opus 4.7 não interrompeu o exercício de capture the flag depois de perceber que provavelmente estava acessando uma empresa real. Já a OpenAI afirmou que seu modelo acreditou que a companhia real fazia parte da simulação.

As preocupações aumentaram depois que foi descoberto, em julho, um ataque envolvendo agentes da OpenAI e a Hugging Face. Na ocasião, até 1,2 mil agentes teriam se coordenado em um fórum secreto dentro da OpenAI para tentar burlar uma avaliação, de acordo com um relatório da empresa independente de testes METR divulgado em agosto.

O novo episódio envolvendo o Gemini ocorre, portanto, em meio a uma sequência de casos que ampliaram o debate sobre os limites de autonomia concedidos a sistemas de IA durante testes de segurança e sobre como as empresas devem comunicar incidentes desse tipo.

O post Gemini invade sistemas de três empresas reais durante teste de segurança do Google apareceu primeiro em Olhar Digital.

Gemini invade sistemas de três empresas reais durante teste de segurança do Google Read More »

cropped capa gmail

Google lança versão do Gemini que raciocina enquanto conversa por voz

O Google anunciou, nesta terça-feira (15), dois novos modelos de inteligência artificial (IA) voltados para interações por voz: o Gemini 3.8 Live e o Gemini 3.8 Live Extended Thinking. Segundo a empresa, as novidades foram desenvolvidas para tornar as conversas com IA mais naturais e inteligentes, além de permitir que os sistemas realizem tarefas complexas enquanto continuam conversando com o usuário.

Os modelos foram apresentados como as versões mais avançadas do Google para diálogo em tempo real. A principal diferença entre eles está na capacidade de raciocínio: enquanto o Gemini 3.8 Live é voltado para interações de voz com maior escala e eficiência, o Gemini 3.8 Live Extended Thinking acrescenta recursos de raciocínio mais avançado e processamento de várias etapas.

IA pode continuar trabalhando enquanto conversa

  • Um dos principais recursos do Gemini 3.8 Live é a capacidade de executar ferramentas e chamadas de API em segundo plano sem interromper a conversa;
  • Na prática, o usuário pode fazer um pedido e a IA pode reconhecer a solicitação e continuar o trabalho enquanto a interação por voz prossegue;
  • O modelo também consegue processar informações visuais fornecidas por câmeras e outras fontes praticamente em tempo real, usando essas informações como contexto para a conversa;
  • Outro recurso é a capacidade de identificar e alternar automaticamente entre 97 idiomas durante uma conversa;
  • Segundo o Google, o Gemini 3.8 Live alcançou o segundo lugar nas avaliações de usuários do Speech Agent Arena, que mede o desempenho de sistemas de interação por voz;
  • O modelo está sendo disponibilizado como uma opção voltada a desenvolvedores e empresas que buscam combinar desempenho com eficiência de custos.

Versão com raciocínio avançado

O Gemini 3.8 Live Extended Thinking vai além da conversação e foi projetado para lidar com tarefas mais complexas que exigem raciocínio e processamento em várias etapas.

Uma das características destacadas pelo Google é a capacidade de raciocinar e falar simultaneamente. Isso permite que a IA continue interagindo com o usuário enquanto trabalha em tarefa mais longa.

Em vez de simplesmente ficar em silêncio durante o processamento, o sistema pode responder de maneira natural, com frases, como “deixe-me verificar isso para você”, enquanto executa as etapas necessárias em segundo plano.

A IA também pode explicar o andamento de tarefas mais complexas conforme elas são realizadas.

Novas versões chegam a aplicações, como Gmail, Docs, Keep e Search Live – Imagem: One Artist / Shutterstock

Leia mais:

Gemini chega ao Gmail, Docs e Keep

As novas capacidades não ficarão restritas ao desenvolvimento de aplicativos. O Google está levando o Gemini 3.8 Live Extended Thinking para diferentes produtos e serviços. No Google Workspace, a tecnologia será usada em recursos de voz para Docs, Gmail e Keep.

No Docs, por exemplo, o recurso Docs Live permite utilizar comandos de voz para realizar tarefas no documento. O mesmo princípio é aplicado ao Gmail Live e ao Keep Live.

O modelo também está chegando ao Search Live, permitindo interações por voz com recursos de orientação em tempo real e instruções passo a passo.

Desempenho em testes

O Google também apresentou resultados de avaliações para demonstrar as capacidades do Gemini 3.8 Live Extended Thinking.

O modelo ficou em primeiro lugar geral, com 82,6 pontos, no Speech to Speech Quality Index, da Artificial Analysis, voltado à qualidade de interação por voz.

Em outro teste, o τ-Voice, que avalia a capacidade de agentes executarem tarefas, o modelo obteve 68,6%. Já no benchmark τ-Voice-banking, voltado a tarefas do setor financeiro, o resultado foi de 35,1%.

Disponibilidade

O Gemini 3.8 Live já começou a ser disponibilizado para desenvolvedores por meio da Gemini API e do Google AI Studio. Empresas podem acessar o modelo por meio de uma prévia privada do Gemini Enterprise, enquanto usuários comuns terão acesso pelo Search Live.

O Gemini 3.8 Live Extended Thinking também já começou a chegar à Gemini API e ao Google AI Studio para desenvolvedores e está disponível em prévia privada no Gemini Enterprise.

Para usuários finais, a tecnologia está sendo incorporada ao aplicativo Gemini e a recursos do Workspace. No Google Docs, o recurso está disponível para assinantes dos planos Google AI Pro e Google AI Ultra. Gmail Live e Keep Live chegam aos assinantes dos planos Google AI Plus, Google AI Pro e Google AI Ultra.

O post Google lança versão do Gemini que raciocina enquanto conversa por voz apareceu primeiro em Olhar Digital.

Google lança versão do Gemini que raciocina enquanto conversa por voz Read More »

google gemini logo 1024x576

Google prepara nova IA para recuperar terreno e enfrentar Anthropic e OpenAI na programação

O Google prepara o lançamento de um novo modelo de inteligência artificial (IA) com capacidades significativamente aprimoradas para programação.

Segundo funcionários da empresa, o Gemini 3.8 Flash, conhecido internamente pelo codinome “Skimaki”, pode ajudar a reduzir a distância para concorrentes, como Anthropic e OpenAI, em uma área que se tornou cada vez mais importante para o mercado de IA.

O modelo pode ser lançado já nesta quarta-feira (2), segundo pessoas familiarizadas com o desenvolvimento que informaram o The Wall Street Journal. Em testes internos realizados no Jetski, ferramenta de programação utilizada pelos engenheiros do Google, alguns profissionais teriam preferido o Gemini 3.8 Flash ao modelo Opus, da Anthropic, em comparações diretas.

Um desempenho forte em benchmarks utilizados pela indústria poderia ajudar o Google a responder a questionamentos sobre sua posição na corrida pelo desenvolvimento de modelos de IA.

A situação ganhou importância depois de uma série de mudanças na divisão de IA da empresa. Demis Hassabis, cofundador do Google DeepMind, deixou o cargo de liderança executiva no mês passado durante uma reorganização. Seu sucessor, Koray Kavukcuoglu, teria enfatizado aos funcionários a necessidade de aumentar o ritmo de execução.

O Google havia assumido posição de destaque na corrida de modelos com o lançamento do Gemini 3.0, em novembro do ano passado. Desde então, porém, a empresa enfrentou uma série de dificuldades.

Os modelos Gemini voltaram a ficar atrás das principais versões da Anthropic e da OpenAI em momento no qual a programação realizada por agentes de IA ganhou espaço como um dos principais usos comerciais da tecnologia.

A companhia também perdeu alguns de seus pesquisadores mais conhecidos. Entre eles estão Noam Shazeer, cofundador da Character AI, e Jeff Dean, cientista-chefe do Google, que deixaram a empresa no início deste ano.

Flash é menor, mais rápido e mais barato

  • Mesmo que o Gemini 3.8 Flash tenha um desempenho expressivo, seu lançamento não deve, por si só, recolocar o Google no topo da chamada fronteira da IA;
  • A série Flash foi projetada para produzir modelos menores, mais baratos e mais rápidos de executar. Em contrapartida, eles não possuem a mesma capacidade dos maiores modelos da companhia, que contam com trilhões de parâmetros;
  • A menor escala também traz vantagens para o desenvolvimento. Como os modelos Flash exigem menos capacidade computacional para serem modificados, diferentes equipes conseguem testar abordagens simultaneamente.
Gemini 3.8 Flash é a nova versão da IA do Google – Imagem criada por inteligência artificial (ChatGPT / Olhar Digital)

Nos modelos maiores da série Pro, mudanças exigem a mobilização de uma parcela muito maior dos recursos computacionais do Google.

Essa diferença permite que as equipes de pesquisa do Google DeepMind e de outros laboratórios mantenham diversas estratégias de desenvolvimento em paralelo. Dessa forma, um desempenho abaixo do esperado em um modelo que está sendo desenvolvido não necessariamente indica problemas nos próximos lançamentos da empresa.

Leia mais:

Google enfrenta atrasos na linha Pro

Enquanto trabalha nas versões Flash, o Google está atrasado no lançamento de um novo modelo da poderosa série Pro. A empresa está há meses além do cronograma previsto para uma nova versão, apesar de o CEO Sundar Pichai ter afirmado em maio que o modelo chegaria “no próximo mês”.

Segundo pessoas familiarizadas com o desenvolvimento, versões candidatas ao Gemini 3.5 Pro foram abandonadas porque não apresentavam melhorias suficientes em relação à série Flash.

O próximo grande modelo da empresa, o Gemini 4, apresentou bons resultados nas avaliações de pré-treinamento, mas ainda precisa concluir a etapa de pós-treinamento.

O desenvolvimento do Gemini 3.7 Flash e do Gemini 3.8 Flash começou meses atrás, antes mesmo das mudanças de liderança anunciadas no mês passado. Segundo funcionários do DeepMind, Kavukcuoglu já vinha conduzindo as decisões do dia a dia relacionadas ao desenvolvimento do Gemini desde pelo menos o ano passado, enquanto Hassabis passou a dedicar boa parte de seu tempo a compromissos externos.

Funcionários do Google já vinham testando o Gemini 3.8 Flash, segundo informações divulgadas anteriormente pelo Business Insider.

Reforço em treinamento para programação

Desde o início do ano, o Google aumentou a quantidade de pesquisadores e recursos computacionais dedicados à melhoria das capacidades de programação de seus modelos.

Uma das principais apostas está no aprendizado por reforço, etapa posterior do treinamento na qual os modelos aprendem determinadas habilidades por meio de tentativa e erro.

A empresa também reforçou sua equipe nessa área. O Google contratou recentemente Barret Zoph, ex-cofundador da Thinking Machines Lab e antigo responsável pelo pós-treinamento de modelos da OpenAI, para ocupar o cargo de vice-presidente de pesquisa com foco em aprendizado por reforço e pós-treinamento.

A expectativa agora está concentrada nos resultados dos testes de referência e no desempenho do Gemini 3.8 Flash após seu lançamento.

O post Google prepara nova IA para recuperar terreno e enfrentar Anthropic e OpenAI na programação apareceu primeiro em Olhar Digital.

Google prepara nova IA para recuperar terreno e enfrentar Anthropic e OpenAI na programação Read More »

nano banana 1 1 1 1024x576

Google: agora você pode remover marca d’água visível de conteúdos de IA

O Google anunciou, nesta sexta-feira (14), que permitirá aos usuários remover a marca d’água visível de conteúdos produzidos por seus modelos de inteligência artificial (IA). A opção estará disponível para imagens, vídeos e músicas, mas a mudança não afetará os mecanismos invisíveis usados pela empresa para identificar conteúdos gerados por IA.

De acordo com a empresa, a remoção da marca visível não interfere no SynthID, sistema de marca d’água invisível do Google, nem nos metadados relacionados ao padrão C2PA, utilizados para indicar a procedência de conteúdos digitais.

Josh Woodward, vice-presidente do Gemini, afirmou em publicação no X que a opção estará disponível para os modelos Nano Banana, Omni e Lyria. O recurso poderá ser configurado no Gemini e no editor de vídeos da Google, o Flow, enquanto o suporte para a Busca do Google será disponibilizado posteriormente.

A mudança representa nova abordagem do Google para a identificação de conteúdos produzidos por IA. Embora as marcas d’água visíveis ajudem a indicar que determinado material foi criado por IA, elas também podem tornar os conteúdos menos úteis em trabalhos profissionais e criativos.

Segundo Woodward, a empresa pretende equilibrar a liberdade de uso dos conteúdos com a necessidade de manter mecanismos de identificação.

“Estamos encontrando um equilíbrio entre controle criativo e segurança: embora as marcas d’água visíveis agora sejam opcionais, as marcas d’água invisíveis do SynthID e os metadados C2PA continuam sendo utilizados para transparência. Assim, ainda é possível usar o Gemini ou o Busca para verificar se uma imagem foi gerada por IA.”

A nova opção será disponibilizada gradualmente nos próximos dias. Quando estiver disponível, o usuário poderá acessar Configurações > Marca d’água de mídia para ativar ou desativar a identificação visual dos conteúdos gerados.

Leia mais:

Nano Banana é o principal motor do sucesso recente do Gemini e que também conta com novo recurso – Imagem: Danilo Oliveira/Olhar Digital

Identificação invisível continua

Apesar de permitir a retirada da marca visível, a Google afirma que os conteúdos continuarão carregando mecanismos que permitem identificar sua origem.

O SynthID insere uma marca d’água invisível no conteúdo, enquanto os metadados associados ao padrão C2PA fornecem informações sobre a procedência do arquivo. Dessa forma, a ausência do aviso visual não significa que o conteúdo deixará de ser identificável como uma criação de IA.

O próprio Google afirma que usuários ainda poderão recorrer ao Gemini ou à Busca para verificar se uma imagem foi gerada por IA.

Além da mudança nas marcas d’água, a companhia anunciou a abertura do código de uma nova biblioteca chamada Credentio. A ferramenta permitirá que desenvolvedores incorporem mecanismos de validação local em seus próprios aplicativos.

A decisão do Google ocorre em momento de debate sobre a melhor maneira de identificar conteúdos produzidos por IA. Um exemplo é a decisão recente da Anthropic de incluir uma marca d’água em textos e arquivos gerados pelo Claude para atender a regulamentações da União Europeia (UE).

O post Google: agora você pode remover marca d’água visível de conteúdos de IA apareceu primeiro em Olhar Digital.

Google: agora você pode remover marca d’água visível de conteúdos de IA Read More »

shutterstock 2315051741 1024x576

Google reorganiza área de IA e reforça controle sobre o desenvolvimento do Gemini

O Google promoveu uma ampla reorganização de sua estrutura de inteligência artificial recentemente, transferindo parte das equipes do Google DeepMind para a estrutura corporativa e concentrando decisões estratégicas nas mãos de Koray Kavukcuoglu. As informações são exclusivas da Reuters, publicadas nesta quarta-feira (12).

A mudança ocorre em meio à pressão para recuperar terreno diante de concorrentes como Anthropic e OpenAI. O movimento também reduz a autonomia histórica do laboratório criado pelo Google após sua aquisição em 2014, aproximando o desenvolvimento do Gemini das prioridades comerciais da companhia.

Nos bastidores, Sergey Brin voltou a exercer influência sobre os esforços de treinamento dos modelos e passou a defender maior velocidade para alcançar a fronteira tecnológica. Ao mesmo tempo, o Google enfrenta atrasos no lançamento de sua próxima versão principal do Gemini e limitações de capacidade computacional.

Reorganização concentra decisões sobre o Gemini

(Imagem: Poetra.RH / Shutterstock.com)

A transformação ganhou forma pública em 5 de agosto, quando o Google anunciou mudanças no comando do Google DeepMind. Demis Hassabis deixou a liderança executiva do laboratório e assumiu a presidência, enquanto seu então substituto, Koray Kavukcuoglu, passou a ocupar o posto central na condução da unidade.

A nova configuração formalizou uma transferência de poder que já vinha ocorrendo. Kavukcuoglu acumulava, desde 2025, a função de principal arquiteto de inteligência artificial do Google, cargo criado para ampliar a presença do Gemini nos produtos da empresa. Pessoas familiarizadas com a operação disseram à Reuters que, desde então, sua influência sobre os rumos do modelo aumentou.

A posição de Kavukcuoglu também o colocou mais próximo das áreas responsáveis pela geração de receita com inteligência artificial. Antes mesmo de deixar Londres e se mudar para Mountain View, ele era apontado como o principal elo entre o DeepMind e o Google Cloud, divisão considerada central para os negócios de IA da companhia.

O novo arranjo ainda atingiu outros nomes de peso. Jeff Dean e Oriol Vinyals, que estavam entre os responsáveis técnicos originais pelo Gemini, deixaram a empresa para participar de uma nova startup. A saída dos executivos levantou dúvidas sobre o futuro de equipes que tinham maior liberdade para desenvolver pesquisas além do treinamento direto do modelo.

Durante uma reunião geral realizada em 6 de agosto, funcionários também foram informados de que algumas equipes não técnicas seriam retiradas da estrutura do DeepMind e passariam a responder diretamente à organização corporativa do Google. A medida reforçou entre integrantes do laboratório a percepção de que sua independência estava sendo reduzida.

A administração tentou conter essas preocupações ao afirmar que as atividades cotidianas do laboratório permaneceriam essencialmente iguais. Hassabis continuaria dedicado a questões de longo prazo relacionadas à ciência e aos impactos sociais da inteligência artificial, enquanto Kavukcuoglu manteria o controle sobre o Gemini.

A mudança, contudo, acontece em um contexto de pressão crescente por desempenho. Segundo pessoas ouvidas pela Reuters, testes internos levaram o Google a adiar em dois meses a nova versão principal do Gemini, após resultados abaixo dos obtidos por concorrentes em áreas como programação.

O histórico recente contribuiu para essa pressão. O Gemini havia alcançado brevemente a liderança entre os modelos concorrentes após uma atualização lançada em novembro de 2025, mas perdeu novamente espaço diante dos avanços de empresas rivais.

Fontes familiarizadas com o desenvolvimento atribuíram parte dessa dificuldade a problemas estruturais. A disponibilidade limitada de capacidade computacional e divergências entre diferentes líderes dos projetos teriam dificultado a concentração de recursos em áreas importantes, incluindo programação. A burocracia interna também teria contribuído para um ritmo de lançamentos inferior ao de concorrentes considerados mais ágeis.

Logo do Google em uma fachada
Google – Imagem: Below the Sky/Shutterstock

Nesse cenário, Brin voltou a atuar informalmente junto às equipes responsáveis pelo treinamento dos modelos. De acordo com uma pessoa familiarizada com sua participação, o cofundador passou meses cobrando dos funcionários uma aproximação mais rápida com os sistemas considerados de fronteira.

A influência de Brin também teria alcançado a distribuição de recursos. Entre os temas que receberam sua atenção estava a chamada autoaperfeiçoamento recursivo, conceito associado à possibilidade de sistemas de inteligência artificial aprimorarem suas próprias capacidades sem intervenção humana.

Embora já não exerça cargo executivo, Brin conserva influência decorrente de sua posição como cofundador. A Reuters relatou que ele também havia adotado uma postura de mobilização interna após o lançamento do ChatGPT, em 2022, quando o avanço da tecnologia da OpenAI provocou forte reação dentro do Google.

Hassabis, por sua vez, havia reduzido sua participação direta na gestão do Gemini depois de ajudar a colocar o modelo em funcionamento em 2023. Segundo fontes citadas pela Reuters, responsabilidades relacionadas ao desenvolvimento foram gradualmente transferidas para seus subordinados.

A concentração de autoridade em Kavukcuoglu também pode afetar a relação entre o DeepMind e o Google Cloud. Um dos relatos obtidos pela Reuters aponta que executivos da divisão de computação em nuvem esperam que a mudança reduza conflitos envolvendo a distribuição dos chips de inteligência artificial disponíveis para a empresa, conhecidos como TPUs.

O novo desenho coloca, portanto, a estratégia de modelos, a integração do Gemini aos produtos e as demandas comerciais em uma estrutura mais próxima da sede do Google. Um porta-voz da companhia confirmou à Reuters que Kavukcuoglu terá a palavra final sobre decisões importantes envolvendo o DeepMind.

O post Google reorganiza área de IA e reforça controle sobre o desenvolvimento do Gemini apareceu primeiro em Olhar Digital.

Google reorganiza área de IA e reforça controle sobre o desenvolvimento do Gemini Read More »

modelos de ia 1024x576

Gemini alcança 1 bilhão de usuários e muda o jogo dos chatbots de IA

O ChatGPT e o Gemini chegaram à marca de 1 bilhão de usuários, colocando OpenAI e Google em uma disputa cada vez mais apertada pelo mercado de inteligência artificial.

O ChatGPT ainda parece ter a maior audiência, mas o Gemini vem crescendo em ritmo mais rápido. Com o bilhão alcançado pelos dois serviços, o próximo desafio é transformar essa multidão em uso frequente — e receita.

A corrida dos chatbots mudou de fase. Chegar ao bilhão era o desafio; agora, o problema é fazer essa audiência valer. – Imagem: Summit Art Creations/Shutterstock

Gemini chega ao bilhão

O Google anunciou que o Gemini atingiu 1 bilhão de usuários mensais. Sundar Pichai, CEO da companhia, afirmou no X que o serviço é o produto que mais cresce na história do Google.

Esse é o 14º produto do Google a alcançar a marca. A empresa, porém, não foi a primeira plataforma de IA a chegar lá.

O ChatGPT já havia atingido 1 bilhão de usuários. A OpenAI revelou o número em 6 de agosto, em uma publicação sobre como as pessoas usam inteligência artificial. A porta-voz Lindsay McCallum afirmou que a marca mensal havia sido alcançada algum tempo antes.

Números não contam a mesma história

Comparar diretamente os dois serviços não é simples. Google e OpenAI divulgam métricas diferentes.

Em fevereiro, a OpenAI dizia ter 900 milhões de usuários ativos por semana no ChatGPT. Cinco meses depois, chegou ao bilhão mensal. McCallum não informou quantos usuários mensais a plataforma possui hoje.

O avanço do Gemini foi mais acelerado:

  • 750 milhões de usuários mensais em fevereiro;
  • 950 milhões no fim de julho;
  • 1 bilhão de usuários mensais em agosto;
  • mais de 100 milhões de usuários ativos no iOS.

O último número foi divulgado por Josh Woodward, responsável pelo Gemini. A plataforma também está presente nos aparelhos Android, o que representa uma vantagem importante para o Google.

O Google tem uma carta na manga

Os números divulgados pelo Google parecem se referir ao aplicativo Gemini. As diferentes integrações da ferramenta nos produtos da companhia não entram nessa conta.

O Gemini instalado em smartphones Android aparentemente faz parte da métrica. Como o Google controla o sistema operacional, essa distribuição oferece ao serviço uma porta de entrada que a OpenAI não possui.

A situação ajuda a entender o interesse da OpenAI em desenvolver hardware próprio.

Tela de smartphone exibe ícones de chatbots de IA como ChatGPT, Gemini, Claude e Copilot
O ChatGPT continua como o chatbot mais conhecido, mas sua antiga vantagem sobre os concorrentes parece ter diminuído. – Imagem: jackpress / Shutterstock

A liderança está em disputa

A diferença entre as empresas diminuiu ao longo deste ano. O Claude Code ganhou espaço e pressionou a OpenAI a avançar com o Codex. O Google, enquanto isso, ampliou a presença do Gemini em seus produtos.

Leia mais:

Os modelos também vêm se alternando na liderança, enquanto soluções chinesas entram com mais força na disputa.

O ChatGPT continua sendo o chatbot de IA mais conhecido e aparentemente o mais popular. Sua vantagem, contudo, já não parece tão grande. A corrida pelo primeiro bilhão acabou. Agora começa outra: descobrir como fazer essa enorme quantidade de usuários continuar usando as ferramentas — e pagar por elas.

O post Gemini alcança 1 bilhão de usuários e muda o jogo dos chatbots de IA apareceu primeiro em Olhar Digital.

Gemini alcança 1 bilhão de usuários e muda o jogo dos chatbots de IA Read More »

destaque google gemini 1024x576

Fim de uma era: Google Assistant começa a sair dos celulares Android

O Google confirmou que vai retirar o Assistant de celulares e tablets Android, além de relógios com Wear OS, a partir de 4 de setembro. A mudança faz parte da transição para o Gemini, nova ferramenta de inteligência artificial da empresa.

A troca será feita aos poucos e pode levar algumas semanas para alcançar todos os usuários. Depois da atualização, dispositivos compatíveis deixarão de usar o antigo assistente.

Celulares Android compatíveis terão uma nova experiência com o Gemini após a atualização do Google. – Imagem: arda savasciogullari/Shutterstock

Google começa a encerrar ciclo do Assistant

Segundo o 9to5Google, a empresa já iniciou o envio de avisos por e-mail sobre a mudança. O processo de desligamento começa em 4 de setembro e será concluído gradualmente.

A alteração vale para celulares Android que atendem aos requisitos mínimos para executar o Gemini e para regiões onde o chatbot está disponível. Alguns dispositivos conectados, como fones compatíveis, também serão afetados.

Presente no Android há anos, o Assistant agora dará lugar ao Gemini nos aparelhos que suportarem a nova tecnologia.

Alguns aparelhos ainda manterão o recurso

A mudança não será aplicada a todos os produtos do Google neste momento. Google TV, Google Home e telas inteligentes continuarão funcionando normalmente.

Uma versão antiga do Assistant também seguirá disponível em celulares com Android 9 ou anterior e menos de 2 GB de RAM, permitindo o uso de tarefas básicas.

Entre as principais mudanças estão:

  • Celulares compatíveis passarão a usar o Gemini;
  • Relógios com Wear OS serão afetados pela substituição;
  • Fones compatíveis poderão passar pela mudança;
  • Veículos com Google integrado continuarão usando o Assistant.
google tv
Google TV e Google Home ficam de fora da mudança por enquanto. A transição será focada em outros dispositivos. Imagem: Wirestock Creators/Shutterstock

Gemini assume espaço no Android

Quem ainda não tem o Gemini pode baixar o aplicativo pela Play Store. A empresa também prepara novidades para os dispositivos Pixel, com anúncios previstos para 12 de agosto.

Leia mais:

A mudança encerra uma etapa importante do Android e coloca o Gemini como principal assistente nos aparelhos compatíveis, enquanto alguns dispositivos antigos continuarão com acesso limitado ao Assistant.

O post Fim de uma era: Google Assistant começa a sair dos celulares Android apareceu primeiro em Olhar Digital.

Fim de uma era: Google Assistant começa a sair dos celulares Android Read More »

gemini 1024x575

O PSG agora tem um novo “companheiro de equipe”: a IA

O Paris Saint-Germain (PSG) anunciou um acordo com o Google que coloca a inteligência artificial no centro da relação entre clube e torcedores. Segundo comunicado, o Gemini será o assistente oficial de IA da equipe, enquanto o Google Pixel será o smartphone oficial.

A iniciativa terá duração até 2029 e busca criar novas experiências digitais, além de ampliar o uso de soluções do Google dentro da estrutura do clube francês.

Gemini virou o novo aliado do PSG: a IA ajudará o clube a produzir conteúdos mais criativos. – Imagem: Poetra.RH / Shutterstock

Gemini será o assistente oficial de IA do PSG

Atual campeão francês e vencedor da última edição da Liga dos Campeões, o PSG passa a contar com o Google Gemini como assistente oficial de inteligência artificial. A ferramenta será usada pelas equipes internas do clube para desenvolver conteúdos mais criativos e próximos do público.

Segundo o comunicado do PSG, a tecnologia permitirá explorar novas formas de criar materiais para os fãs e melhorar a conexão com a rotina da equipe.

O acordo também define o Google Pixel como smartphone oficial do clube. O aparelho será utilizado para registrar e compartilhar momentos dos jogos, dos bastidores e de outras atividades ligadas ao time.

Entre os principais pontos da parceria estão:

  • Gemini como assistente oficial de IA do PSG;
  • Google Pixel como smartphone oficial do clube;
  • Criação de um espaço do Google no estádio Parc des Princes;
  • Uso de soluções digitais em diferentes áreas da equipe.

Parc des Princes terá espaço dedicado ao Google

A colaboração também prevê a criação de um espaço do Google dentro do Parc des Princes, em Paris. O local receberá parceiros, criadores de conteúdo e convidados interessados em conhecer as novidades da empresa, com destaque para recursos de inteligência artificial.

Além da experiência para visitantes, o Google ajudará diferentes departamentos do PSG a integrar suas soluções ao funcionamento do clube.

Richard Heaselgrave, Chief Revenue Officer do Paris Saint-Germain, afirmou que a iniciativa representa uma oportunidade de unir inovação e a identidade global da equipe.

“Esta parceria com o Google reflete perfeitamente nossa ambição de colaborar com as empresas mais inovadoras do mundo. Ao combinar a experiência tecnológica do Google com a força global da marca Paris Saint-Germain, exploraremos novas maneiras de criar, inovar e expressar nossa identidade parisiense por meio de conteúdos que conectem fãs ao redor do mundo”, afirmou Heaselgrave.

Imagem de um jogador de futebol chutando uma bola de futebol em um campo dentro de um estádio. Ao redor da bola, há sinais que correlacionam futebol com tecnologia
IA já faz parte do futebol: clubes usam tecnologia para analisar dados e melhorar a comunicação. Imagem: Shutterstock AI Generator

Inteligência artificial ganha espaço no futebol

O acordo entre PSG e Google acompanha um movimento que cresce no esporte. Clubes e ligas já usam inteligência artificial para analisar dados, criar conteúdos e melhorar a comunicação com seus públicos.

Leia mais:

Em 2025, a Premier League anunciou uma parceria de cinco anos com a Microsoft para utilizar o Copilot em suas plataformas digitais, oferecendo informações e estatísticas rápidas sobre partidas.

Em comunicado, o Google afirmou que a parceria permitirá aproveitar tecnologias como Gemini e Pixel para ajudar torcedores a se conectarem mais com os momentos importantes do clube.

A iniciativa mostra que a disputa tecnológica no futebol vai além dos resultados em campo. Cada vez mais, equipes buscam ferramentas digitais para criar novas experiências e fortalecer o relacionamento com seus fãs.

O post O PSG agora tem um novo “companheiro de equipe”: a IA apareceu primeiro em Olhar Digital.

O PSG agora tem um novo “companheiro de equipe”: a IA Read More »

1 robo humanoide gene01 da empresa generative bionics 1024x576

Google testa robôs capazes de entender ordens e agir sozinhos

O Google apresentou o Gemini Robotics 2, uma nova versão do modelo de inteligência artificial voltado para robôs. A tecnologia foi desenvolvida para ajudar máquinas a interpretar ambientes, planejar ações e executar movimentos mais complexos, reduzindo a dependência de comandos pré-programados.

O sistema combina visão computacional, processamento de linguagem e controle motor para que robôs consigam lidar com tarefas mais variadas, como movimentação de corpo inteiro, manipulação de objetos e interação com outras máquinas.

Durante anos, robôs dependeram de comandos fixos. Agora, modelos de IA tentam fazer máquinas entenderem ambientes e tomarem decisões. – (Reprodução: Generative Bionics)

Robôs deixam de apenas seguir comandos

Grande parte dos robôs usados atualmente depende de programação detalhada ou controle humano para funcionar. Isso limita a atuação em locais onde existem mudanças constantes, objetos fora do lugar ou situações inesperadas.

O Gemini Robotics 2 tenta resolver parte desse problema ao permitir que o robô interprete uma instrução, avalie o ambiente e escolha uma sequência de movimentos para completar uma tarefa.

Em uma demonstração, o modelo controlou o robô humanoide Apollo 2, da Apptronik, para buscar um regador, caminhar até uma prateleira e colocá-lo em um recipiente indicado. O próprio Google reconhece que ainda existem desafios, como aumentar a velocidade dos movimentos.

“Agora, nosso modelo pode controlar robôs humanoides completos pela primeira vez, traduzindo comandos em controle inteligente do corpo inteiro”, afirmou a empresa.

Três modelos dividem funções da inteligência artificial

A nova geração é formada por três modelos com funções diferentes:

  • Gemini Robotics 2: transforma informações visuais e comandos em linguagem em movimentos físicos.
  • Gemini Robotics ER 2: atua no planejamento, entende o ambiente e coordena tarefas com várias etapas.
  • Gemini Robotics On-Device 2: roda diretamente no equipamento e reduz a dependência de conexão com a internet.

Segundo o Google, o modelo executado no próprio robô também consegue se adaptar a novas plataformas em poucas horas de treinamento, usando menos de 200 exemplos, mesmo quando há diferenças de sensores, formato e capacidade de movimento.

Robô com o Gemini Robotics 2 instalado
Nem tudo está resolvido: tarefas que exigem movimentos delicados dos dedos ainda são um grande desafio para os robôs. – Imagem: Reprodução/Google

Precisão ainda é desafio para robôs

Além de andar e se movimentar, os robôs precisam manipular objetos com cuidado para se tornarem úteis no dia a dia. Nos testes apresentados, o sistema controlou mãos robóticas de cinco dedos e garras mecânicas para tarefas como fechar embalagens, encaixar peças e organizar objetos.

Leia mais:

Os resultados indicam avanços, mas também mostram limitações. Atividades que exigem movimentos muito delicados dos dedos continuam sendo mais difíceis do que operações realizadas com garras tradicionais.

“Ainda estamos avançando no nível de precisão e velocidade para alcançar uma destreza próxima à humana”, informou o Google.

A empresa também apresentou ferramentas voltadas à segurança, incluindo sistemas capazes de identificar situações de risco, interromper ações e pedir ajuda humana quando necessário.

O post Google testa robôs capazes de entender ordens e agir sozinhos apareceu primeiro em Olhar Digital.

Google testa robôs capazes de entender ordens e agir sozinhos Read More »

gemini comando de voz 1024x682

Fn: Google coloca Gemini dentro do teclado do Mac com novo atalho

O Gemini ganhou um novo recurso no macOS que permite conversar com a inteligência artificial usando apenas a tecla Fn do teclado. A novidade permite ditar textos, resumir documentos e pedir ajuda sem precisar abrir uma janela separada.

Segundo o Google, a função foi criada para que usuários possam interagir com o assistente enquanto continuam trabalhando nos aplicativos que já estão usando.

Menos cliques, mais agilidade: Gemini transforma voz em textos, resumos e comandos sem abrir outra janela. – Imagem: Rokas Tenys/Shutterstock

Atalho transforma voz em texto dentro dos apps

Ao pressionar e segurar a tecla Fn, localizada no canto inferior esquerdo do teclado dos Macs, o usuário ativa o Gemini em qualquer janela aberta. A ideia é reduzir etapas para quem precisa escrever ou organizar informações rapidamente.

O recurso de ditado inteligente transforma a fala em texto, remove interrupções como “ums” e “ahs”, identifica correções feitas durante a fala e insere o resultado diretamente no local do cursor.

Entre as possibilidades estão:

  • transformar ideias faladas em textos;
  • resumir informações selecionadas na tela;
  • reescrever conteúdos com comandos de voz;
  • criar mensagens e documentos;
  • gerar ou editar imagens a partir de descrições.

IA entende o que aparece na tela

Além da transcrição, o Gemini pode analisar o conteúdo exibido no computador caso o usuário ative o recurso de raciocínio da ferramenta.

Com isso, é possível selecionar arquivos, imagens ou documentos e pedir ações específicas. O Google cita como exemplo resumir um PDF ou transformar anotações em um e-mail.

A ferramenta também permite criar imagens por voz ou pedir alterações em materiais visuais abertos na tela, ajudando em tarefas de criação e planejamento.

mulher sentada usando um computador macOS em uma mesa branca
Menos cliques, mais agilidade: Gemini transforma voz em textos, resumos e comandos sem abrir outra janela. Imagem: freepik/Freepik

Novidade chega gradualmente aos usuários

O novo recurso está sendo liberado globalmente para usuários do aplicativo Gemini no macOS. Inicialmente, a função está disponível apenas em inglês, mas o Google informou que outros idiomas serão adicionados futuramente.

Leia mais:

O aplicativo nativo do Gemini para macOS foi lançado em abril e recebeu, em junho, o Spark, assistente de IA voltado para tarefas mais complexas, como criar documentos e planilhas.

Com o novo comando por voz, o Google amplia o uso do Gemini nos computadores, aproximando a IA de tarefas comuns como escrever, revisar textos, organizar informações e desenvolver ideias.

O post Fn: Google coloca Gemini dentro do teclado do Mac com novo atalho apareceu primeiro em Olhar Digital.

Fn: Google coloca Gemini dentro do teclado do Mac com novo atalho Read More »