Jalapeño: OpenAI entra no hardware de inferência com chip próprio
OpenAI lança Jalapeño, processador de inferência feito com Broadcom. Menor custo por watt? O que muda para quem usa modelos como Codex?
OpenAI lança Jalapeño, processador de inferência feito com Broadcom. Menor custo por watt? O que muda para quem usa modelos como Codex?
Anthropic revela que Claude gera mais de 90% do código interno, enquanto alerta para riscos de autoaperfeiçoamento. Análise de métricas e dilemas práticos.
NSA usa Mythos da Anthropic para operações cibernéticas ofensivas contra China e Irã. Engenheiros da Anthropic alocados. O que isso significa para ética e segur
SpaceX aluga 110 mil GPUs NVIDIA para Google por US$ 920M/mês. Entenda o impacto para nuvem e custos de inferência.
Google lança Gemma 4 QAT com quantização-aware training, reduzindo memória para 1GB. Veja como isso afeta quem roda modelos localmente.
Ferramenta Tenure promete memória persistente para LLMs sem vazamento de contexto, alcançando 100% de precisão e superando busca vetorial.
General Instinct comprime Qwen3.5-122B para rodar em hardware de borda com desempenho superior. Como fizeram e o que isso muda na prática.
Uber, Microsoft e Priceline estouraram budgets de IA. Tokenomics Foundation quer criar padrões de custo, mas a crise já está instalada. Saiba como monitorar e controlar gastos com tokens.
AirTrunk anuncia US$30 bi e 5GW de data centers na Índia. Análise técnica: custos, gargalo energético, impacto para hyperscalers e ação prática.
Mira Murati apresenta modelos de interação contínua com latência de 200ms. Análise técnica do que isso muda na arquitetura de IA e se o custo compensa para produção.
Anthropic registra IPO confidencial com valuation de $965B. Amodei fala sobre capital para treinar modelos e servir inferência. Os riscos de gastos corporativos com IA.
Brian Chesky, CEO do Airbnb, está montando seu próprio laboratório de IA. O que isso significa para o mercado de modelos e para a relação com Sam Altman?