GLM-5.2: o salto real para agentes abertos
GLM-5.2 ultrapassa um limiar crítico: pela primeira vez, um modelo open source rivaliza com agentes fechados. Veja o que muda.
GLM-5.2 ultrapassa um limiar crítico: pela primeira vez, um modelo open source rivaliza com agentes fechados. Veja o que muda.
Cascade é um proxy C++ que roteia requisições LLM dinamicamente, cortando custos em até 70% sem adicionar latência. Ideal para quem usa APIs pesadas.
Startup Ferveret usa técnica de bolhas inspirada em reatores nucleares para resfriar servidores com zero água e até 35% mais tokens por watt.
Conheça o DiffusionGemma, modelo experimental da DeepMind que gera texto até 4x mais rápido usando difusão. Veja os trade-offs e o impacto prático.
Novo chip do MIT mapeia ambientes 3D em tempo real com apenas 6mW, usando gaussianas em vez de voxels. Revolução para robôs pequenos e AR.
Governo dos EUA força Anthropic a desligar Claude 5. Entenda o impacto na governança de IA e o que muda para desenvolvedores.
Alibaba teria extraído capacidades do Claude da Anthropic. Entenda o caso e o que muda para segurança de modelos de IA.
OpenAI e Broadcom anunciam chip otimizado para inferência de LLMs em larga escala. Entenda o impacto no custo e latência para quem opera modelos.
DeepMind lança Gemma 4 12B, modelo multimodal sem encoder que roda localmente com 16GB de RAM. Veja como funciona na prática.
Microsoft treinou modelos MAI com Common Crawl, contradizendo promessa de dados licenciados. Entenda o impacto e as implicações legais.
A TSMC, maior fabricante de chips, alerta que a demanda por semicondutores para IA está além da capacidade, mesmo com bilhões em investimento nos EUA.
CEO da Microsoft critica memorando interno que propunha design viciante para agente Scout. 'Absolutamente não é um objetivo', afirmou.