Dots da OpenAI era para resolver trabalho de verdade, mas emperra no clique
Dots da OpenAI chegou com uma promessa que parece simples e ao mesmo tempo impossível de ignorar. Ter um coworker digital que mexe em software de verdade, abre navegador, usa Blender e GIMP, vasculha seu e-mail e ainda pede seu jantar se precisar. Na teoria, é o Codex para gente normal. Na prática dos meus primeiros testes, é um funcionário enterprise muito educado que trava justo na hora que você mais precisa, um captcha de pressione e segure, um checkout com conta bancária, um login no Ikea. E essa tensão entre autonomia total e dependência humana constrangedora é o que define o produto agora.
O fato é direto. A OpenAI anunciou o Dots nesta semana como sua nova plataforma de agentes pessoais com cara de brinquedo. Cada usuário ganha um Dot, com avatar arredondado e nome personalizável. O meu, se eu assinasse, provavelmente se chamaria Dotty McDotface só para aliviar o clima corporativo. A interface é dividida em duas partes, de um lado você conversa, do outro você assiste o agente clicar numa máquina virtual na nuvem. Ele pode acessar aplicativos já instalados, pode receber acesso ao seu próprio computador pelo app de desktop do ChatGPT e pode até atender uma ligação para resolver as coisas falando em voz alta.
O que o Dots realmente é por baixo do capô
Só que o detalhe que importa não é o avatar fofo. É quem pode usar. O Dots está disponível primeiro para contas de nível mais alto, incluindo o plano Pro de 100 dólares por mês. Isso já posiciona o produto. Enquanto o Meta Muse e o concorrente Instinct são gratuitos por enquanto, a OpenAI cobra caro e entrega algo com cheiro de software de trabalho que por acaso consegue pedir um burrito. Não é um personal shopper. É um software de negócio que opera outros softwares. Essa diferença muda tudo no custo, na latência e na expectativa.
Como operador, o que vejo aqui é uma arquitetura de agente com computador virtual efêmero mais controle de navegador por modelo de visão. Provavelmente cada sessão do Dot sobe um container com desktop, navegador e alguns apps pré-instalados. O modelo observa screenshots, planeja cliques e digitação, executa e reavalia. Isso explica a latência alta e a sensação de estar vendo um estagiário remoto trabalhando devagar. O acesso ao seu PC via app de desktop sugere um segundo modo, mais arriscado, onde o agente opera localmente com permissões do sistema. E a chamada de voz indica que há uma camada de acompanhamento síncrono, útil para desambiguar, mas que também aumenta o custo de inferência por tarefa.
O custo aqui não é só a assinatura. É o custo por tarefa bem sucedida. Se uma tarefa leva 12 minutos de navegação autônoma, com dezenas de chamadas de visão e raciocínio, mais uma intervenção humana no meio, o preço efetivo explode. A OpenAI não abriu números de tokens ou tempo de VM, então dá para inferir de forma plausível que tarefas longas vão consumir muito mais contexto e vão falhar mais. Cada falha no meio, como um login que não passa ou um botão que exige segurar o mouse, joga todo o trabalho anterior no lixo. É diferente de gerar código, onde você pode retomar do diff. Em RPA com linguagem natural, o estado é a página web, e ela muda o tempo todo.
Testes reais mostram onde a autonomia quebra
Nos testes com tarefas do dia a dia, esse limite apareceu rápido. Pedi para o Dot agendar uma instalação com um novo provedor de internet. Ele foi até bem no começo. Vasculhou meu e-mail, achou um desconto promocional de 100 dólares que eu tinha deletado em massa, navegou até o fluxo de agendamento. Aí bateu no famoso human check. A mensagem foi honesta até demais, esse check específico precisa de um clique longo do mouse que meus controles de navegador não suportam. Tive que abrir o navegador dele e segurar o botão de pressione e segure por ele. Pareceu aquela cena de adolescentes na porta da loja pedindo para um adulto comprar algo por eles. Funciona, mas quebra completamente a ideia de autonomia.
Depois do captcha, veio o checkout. O provedor pedia dados bancários para dar 5 dólares de desconto mensal. Não havia integração elegante como a do Muse, que salva seu cartão e usa um cartão virtual no checkout. O Dot simplesmente pausou e pediu para eu digitar minha conta corrente na máquina virtual dele. Eu não confiei o suficiente para fazer isso e acabei desistindo para fazer tudo no meu próprio computador. Do ponto de vista de produto, é um buraco enorme. Sem vault de pagamento, sem cartão virtual, sem máscara de dados sensíveis, o agente enterprise vira um risco de segurança para tarefas pessoais. E convenhamos, pedir jantar sem pagar de forma segura não escala.
Outros testes reforçaram a inconsistência. Pedi para achar a opção de tour gratuito em um coworking que eu queria conhecer. O Dot não achou e me ofereceu um day pass de 35 dólares. Coloquei o agente do Instinct na mesma tarefa e ele achou a opção de teste e marcou o horário em minutos. Quando questionei o Dot por telefone, ele respondeu, cheguei à conclusão errada. Desliguei. Depois pedi para recuperar informações de um vaso pendente na minha conta Ikea e ele nem conseguiu fazer login. São três modos de falha diferentes, navegação, interpretação de oferta e autenticação, que juntos mostram que o sistema ainda não tem memória robusta de padrões de sites nem fallback inteligente.
O que isso muda para quem constrói com agentes
Quem ganha com o Dots hoje é a equipe que já vive dentro do ecossistema da OpenAI e precisa de automação assistida para trabalho de escritório. Gerar um arquivo no Blender, organizar prints no GIMP, raspar dados de um portal interno, resumir e-mails para achar cupons, tudo isso com supervisão humana, faz sentido. Quem perde é quem esperava um agente doméstico totalmente autônomo que resolve burocracia chata sem você olhar. Para isso, checkout, login persistente e anti bot são o núcleo do produto, não detalhe. E é exatamente aí que o Dot é mais fraco que concorrentes gratuitos focados em compras.
Se você vai testar, mude seu setup agora. A ação prática mais importante é criar um ambiente separado para o agente antes de dar qualquer acesso. Use um perfil de navegador isolado, uma conta de e-mail secundária para promoções e logins de baixo risco, e nunca entregue conta bancária ou senha principal na VM compartilhada. Segunda ação, defina tarefas com critério de parada claro, como pare se pedir pagamento ou login novo e me avise. Isso evita que o agente alucine um plano B caro, como comprar um day pass quando existia um tour grátis. Terceira ação, grave o passo a passo das tarefas que funcionam. Agentes de VM ainda não aprendem sozinhos entre sessões de forma confiável, então seu playbook manual vira o verdadeiro ativo.
- Crie um usuário de teste para Ikea, operadora e delivery antes de conectar o Dot.
- Prefira tarefas de leitura e organização a tarefas de compra com pagamento real.
- Use a chamada de voz só para destravar decisões, não para vigiar cada clique.
A dúvida que fica é se isso escala ou só muda o gargalo
Aqui está a tensão real. O Dots resolve parte do problema de usar software com linguagem natural, mas move o gargalo para outro lugar, a confiança e a última milha física da web. Captchas feitos para barrar bots vão continuar barrando bots, mesmo que fofos. Checkouts sem cartão virtual vão continuar exigindo que você digite dados sensíveis num computador que não é seu. Logins com autenticação em duas etapas vão continuar pedindo seu celular. No fim, você economiza cinco minutos de cliques e gasta sete minutos supervisionando, segurando botão e conferindo se ele não comprou o plano errado. Para empresa, com processos repetitivos e acessos controlados via API, isso pode compensar. Para vida pessoal, com sites bagunçados e anti fraude, ainda parece caro pagar 100 dólares por mês para ser babá de robô.
Vale assinar agora ou esperar a poeira baixar
Resumindo em duas frases. O Dots é um passo sólido rumo ao coworker que opera software de verdade, mas hoje ele é mais enterprise assistido do que autônomo pessoal. A pergunta que fica para você testar no seu contexto é simples, quantas das suas tarefas semanais sobrevivem a um captcha, um login e um pagamento sem você intervir.



Comentários
0 comentáriosNenhum comentário ainda. Seja o primeiro a comentar.