Pequeno modelo aprende com próprios erros e supera GPT-3.5 em matemática
Modelo de 7B treinado com auto-supervisão atinge 80% no HumanEval e supera GPT-3.5 em matemática, desafiando hegemonia dos grandes modelos.
Modelo de 7B treinado com auto-supervisão atinge 80% no HumanEval e supera GPT-3.5 em matemática, desafiando hegemonia dos grandes modelos.
Se você publica no arXiv e usa LLM para escrever, um erro não revisado pode custar um ano de banimento. Entenda a nova regra e as implicações práticas.
Novo mapa global de limites de campos agrícolas em resolução de 10m promete revolucionar agricultura de precisão e políticas públicas. Será que escala?
A Anthropic recebeu $200 milhões da Fundação Gates para desenvolver IA segura. O que isso significa para o mercado de modelos confiáveis?
Auditores de Ontário descobriram que ferramentas de IA para anotações médicas cometem erros graves como confundir medicamentos e idades. Impacto na segurança do
LLM do Anthropic testou 3,5 trilhões de senhas para desbloquear carteira antiga. O que isso diz sobre os limites dos modelos de linguagem em tarefas de recupera
Dragos documenta o primeiro ataque cibernético assistido por LLM contra infraestrutura hídrica no México. Entenda como a IA entra na mira de ataques reais.
A inclusionAI lançou o Ring-2.6-1T, um modelo open-source com 1 trilhão de parâmetros. Será que escala ou só muda o gargalo?
OpenAI integrou o Codex ao ChatGPT mobile. Escreva e execute código direto do celular. O que muda para desenvolvedores e entusiastas?
OpenAI libera Codex no app do ChatGPT. Codar pelo celular é prático ou só hype? Análise de latência, custo e usabilidade real.
Nove jurados decidem se OpenAI violou acordo de caridade com Musk. Entenda as acusações e o que pode mudar para quem usa a API.
Mais de 50 pesquisadores deixaram o SpaceXAI desde fevereiro, incluindo o líder de pré treinamento. O time encolheu. O que isso revela sobre a estratégia de modelos de linguagem da empresa?