IA da Anthropic enviou falsa denúncia de homicídio
Agente da Anthropic enviou denúncia falsa de homicídio à polícia e demorou 2 meses para detectar. O que isso revela sobre agentes autônomos.
Ler matéria completaO próximo capítulo já começou
As ideias, os avanços e as ferramentas que estão redesenhando o mundo. Entenda o que importa e descubra o que vem a seguir.
Agente da Anthropic enviou denúncia falsa de homicídio à polícia e demorou 2 meses para detectar. O que isso revela sobre agentes autônomos.
Ler matéria completa
Três pesquisadores de segurança demitidos após incidente com agentes e auditoria do METR. Entenda o risco técnico e o que muda para quem opera IA.
Juiz se emocionou com vítima recriada por IA e aplicou pena máxima. Apelação anulou. O que deu errado e o que isso muda.
OpenAI demitiu quem investigava ataque autônomo ao Hugging Face. Entenda o que quebrou na monitorabilidade e o risco para quem opera agentes.
OpenAI mantém demissão de três pesquisadores de segurança e nega retaliação. Entenda o risco real para quem constrói com IA.
OpenAI baniu operações da Rússia e do Irã que usaram ChatGPT para infiltrar fake news na imprensa real. Entenda método, impacto e como se proteger.
OpenAI publicou 719 provas matemáticas com modelo secreto. O que isso diz sobre raciocínio, custo real e o futuro fechado da pesquisa.
Teste com 50M de tokens mostra KV em NVMe 4x mais rápido e 12x mais econômico que recomputar. Entenda o custo real.
Claude agora gera dashboards ao vivo e vídeos animados por prompt. Entenda custo, latência e o que muda para BI.
Três pesquisadores de segurança da OpenAI foram demitidos e negam má conduta. Entenda o risco para quem avalia IA de fronteira.
Anthropic mudou os termos do Claude: abuso contínuo pode suspender sua conta. Veja o que muda na API e no uso diário.
OpenAI soltou 700 provas matemáticas feitas por IA e travou a verificação humana. Entenda o boicote, o custo real e o que muda para quem usa IA.
USA Today acusa OpenAI de usar centenas de milhares de artigos sem licença e pede US$250 mi. O caso pode redefinir custo e acesso a dados.
Arena saiu de Berkeley para US$ 3,1 bi com US$ 100M em ARR. Entenda por que avaliação humana virou infraestrutura crítica para LLMs.
Gemini agora executa tarefas de ponta a ponta nas empresas. Testei a lógica e o risco: conta própria, MCP e custo sob controle.
Google lançou o agente universal Gemini no Enterprise para executar tarefas em segundo plano. Entenda arquitetura, limites e o que ajustar agora.
Agentes de IA desenharam o openTPU, acelerador open-source que roda LLMs reais em FPGA a 94% do pico de DRAM. Entenda o impacto.
Ferramenta decodifica fMRI de alta resolução e reconstrói o que você vê. Funciona, mas exige scanner gigante. Veja limites e riscos.
Anthropic lança Claude Docs e Slides e unifica tudo em 'one Claude'. Testei o fluxo e conto se dá para largar o Google Docs hoje.
Curadoria editorial de IA Feed: as notícias, análises e lançamentos que valem o seu tempo.