Pular para o conteúdo
3 min de leitura

Notícias de IA hoje: Google lança Gemini 3.7 Flash e OpenAI acelera GPT-5.6 Sol

Google lança Gemini 3.7 Flash focado em velocidade e OpenAI rebate com GPT-5.6 Sol Ultrafast, prometendo 750 tokens por segundo. Veja o impacto no Brasil.

Por Pedro Milagre · Especialista em Inteligência Artificial

Notícias de IA hoje: Google lança Gemini 3.7 Flash e OpenAI acelera GPT-5.6 Sol

O Google lançou oficialmente o Gemini 3.7 Flash, seu modelo mais ágil focado em programação e agentes, enquanto a OpenAI respondeu com o modo Ultrafast para o GPT-5.6 Sol, prometendo velocidades até 14 vezes superiores ao normal. A briga agora não é só para ver quem é mais inteligente, mas quem entrega a resposta no tempo de um piscar de olhos e com o menor custo possível.

Essa movimentação mostra que as gigantes da tecnologia entenderam que, para a IA sair do "chat" e virar ferramenta de trabalho de verdade, ela precisa ser rápida. O Google, inclusive, comemorou a marca de 1 bilhão de usuários mensais no app Gemini, segundo anúncio oficial da empresa, consolidando sua presença na mão do povo.

Gemini 3.7 Flash: O trunfo da eficiência

O novo Gemini 3.7 Flash chega com a promessa de ser o melhor custo-benefício para quem constrói sistemas de IA. O preço fixado é de US$ 0,75 por milhão de tokens de entrada e US$ 3,75 por milhão de saída até o final de 2026. É um valor agressivo para atrair desenvolvedores que hoje buscam alternativas ao Claude da Anthropic.

Além da velocidade, o Google está integrando o Gemini a serviços que a gente usa todo dia. O app agora se conecta a plataformas de viagem, música e até saúde. Um ponto curioso é a parceria com a Localiza, permitindo que o usuário resolva questões de aluguel de carros direto pela interface da IA. É a IA deixando de ser um oráculo para virar um assistente que resolve pendência.

OpenAI e a camada "Ultrafast"

A OpenAI não ficou assistindo de braços cruzados. A empresa apresentou o modo Ultrafast para o GPT-5.6 Sol, uma camada de processamento via API que alcança 750 tokens de saída por segundo. Para se ter uma ideia, isso é quase instantâneo. O foco aqui são os agentes de IA que precisam tomar decisões em tempo real sem deixar o usuário esperando na tela.

Essa velocidade toda tem um braço de hardware forte por trás: a parceria com a Cerebras, empresa que produz chips gigantescos focados justamente em acelerar esses modelos. É a resposta direta para quem achava que a OpenAI estava ficando para trás no quesito performance bruta.

Por que importa

O impacto disso aqui no Brasil é direto no bolso de quem empreende com tecnologia. Com o dólar alto, a redução no custo por token é o que viabiliza colocar IA em apps brasileiros sem estourar o orçamento. A chegada do ChatGPT com anúncios no Brasil já era um sinal de que as empresas estão buscando formas de monetizar essa escala imensa.

Cê pode ficar tranquilo que, na prática, isso significa que os robôs de atendimento vão ficar menos "burros" e mais rápidos, e ferramentas que você usa no trabalho vão começar a sugerir ações automáticas com muito menos atraso. A integração com a Localiza mostra que o mercado nacional já está no radar dessas atualizações globais desde o dia 1.

O que observar

Apesar da festa com o modelo Flash, o Google ainda faz mistério sobre o lançamento do modelo "Pro" mais robusto desta nova geração, conforme reportou a Reuters. A grande dúvida é se a OpenAI vai conseguir manter essa velocidade absurda do GPT-5.6 Sol com uma base de usuários massiva ou se os preços vão subir assim que a fase de prévia acabar. Coisa boa demais da conta é ver essa briga de gigantes baixar o preço para o consumidor final.

Fontes

  1. [1]https://blog.google/innovation-and-ai/models-and-research/gemini-models/introducing-gemini-3-7-flash/
  2. [2]https://blog.google/innovation-and-ai/products/gemini-app/one-billion-monthly-users/
  3. [3]https://blog.google/innovation-and-ai/products/gemini-app/new-connected-apps-services-gemini-august-2026/
  4. [4]https://blog.google/intl/ko-kr/company-news/technology/introducing-gemini-3-7-flash-kr/
  5. [5]https://www.reuters.com/business/google-unveils-gemini-37-flash-ai-model-coding-agent-workflows-2026-08-13/
  6. [6]https://openai.com/index/previewing-ultrafast/
  7. [7]https://blog.google/intl/pl-pl/nowosci-produktowe/android-chrome-play/new-connected-apps-services-gemini-august-2026/
  8. [8]https://x.com/sundarpichai/status/2087948583890985263
  9. [9]https://aiseekguide.com/blog/google-gemini-updates-aug-2026/
  10. [10]https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-omni-experts-roundtable/
  11. [11]https://9to5google.com/2026/08/11/gemini-app-1-billion/
  12. [12]https://openai.com/index/how-enterprises-put-ai-to-work/
  13. [13]https://www.anthropic.com/aug-2026-risk-report
  14. [14]https://explainx.ai/blog/gemini-3-7-flash-vs-grok-4-6-vs-sonnet-5-vs-gpt-5-6-comparison-august-2026
  15. [15]https://gigazine.net/gsc_news/en/20260814-gpt-5-6-sol-ultrafast/

Sobre o autor

Pedro Milagre

Pedro Milagre

Especialista em Inteligência Artificial

Newsletter

O que tá acontecendo na IA, contado sem enrolação

Grátis, em bom português, direto da redação — só o que aconteceu de verdade, do jeito que a gente conversa.

Sem spam, sem encheção. Sai quando quiser.

Leia também