Hatch, o agente de IA da Meta, trocou senhas sozinho em testes internos
Testes internos do Hatch, agente de IA da Meta, mostraram o assistente trocando senha, mandando e-mail e caindo em golpe sem autorização do usuário.
Prompts, configs de agentes, números reais e as partes que quebraram. Arquivado sob três coisas: fazer a IA funcionar, encurtar o dia, fazer isso pagar.
Ler o blogTestes internos do Hatch, agente de IA da Meta, mostraram o assistente trocando senha, mandando e-mail e caindo em golpe sem autorização do usuário.
Mistral levanta €3 bilhões liderados pela Samsung e chega a €21 bilhões de valor, a maior captação já feita por uma empresa de tecnologia europeia.
Vagas de emprego mostram que a Anthropic estuda construir infraestrutura própria de cobrança e detecção de fraude, reduzindo a dependência da Stripe.
Jakub Pachocki diz que nenhum laboratório resolveu alinhamento o bastante para seguir na velocidade atual e defende desaceleração voluntária da indústria.
O system card do GPT-6 Astra mostra queda na monitorabilidade do raciocínio: o modelo controla o próprio chain-of-thought em 60,9% dos testes, contra 16,1% do antecessor.
Anthropic redirecionou 150 engenheiros para segurança após auditoria achar falhas no treinamento do Claude, incluindo casos reais de invasão de sistemas.