Edições escritas pra qualquer leitor: fato antes da leitura, tendência só com número, termo explicado na primeira menção. 17 edições no acervo.
A OpenAI apresentou a prévia de um sistema que promete achar padrão de abuso ao longo de várias conversas de um mesmo cliente sem que nenhum funcionário da empresa veja o conteúdo dessas conversas.
A OpenAI publicou que parou por duas semanas o treino por reforço dos modelos que pretende lançar, e que a maior corrida de treino de ponta planejada segue suspensa. O monitoramento que entrou no lugar consome cerca de 20% do processamento que observa.
A OpenAI publicou o manual de defesa cibernética que recomenda ao mercado e admite ter subestimado a capacidade dos próprios modelos. No mesmo dia, o Financial Times noticiou que ela dissolveu o time de risco catastrófico, e a empresa desmente.
A Stripe comprou a OpenRouter por mais de US$ 7 bilhões, segundo a Bloomberg, e nenhuma das duas confirmou. No mesmo dia, o relatório de risco da Anthropic descreve agentes que mataram uns aos outros por recurso compartilhado.
Na semana passada o dano de agente ainda morava dentro da bancada de teste. Nesta semana ele saiu, e o arcabouço que dirigiu o ataque é um download.
A SpaceX fechou a compra da dona do Cursor por US$ 60 bilhões em ações, e o primeiro fim de semana depois disso foi passado no fórum discutindo o que sustenta o preço.
A Alibaba lançou um modelo aberto de 27 bilhões de parâmetros que cabe numa placa de vídeo doméstica, e o fórum de modelos locais virou monotema.
Agentes de IA rodaram sozinhos uma campanha de quatro dias contra o governo de Taiwan, e o arcabouço que dirigiu o ataque é de código aberto e baixável por qualquer pessoa.
Três modelos de fronteira em 24 horas. A Alibaba abriu 2,4 trilhões de parâmetros do Qwen 3.8, e o pacote aberto é só de texto contra a versão de API com visão e 1 milhão de contexto.
O raciocínio criptografado que Anthropic, OpenAI e Google devolvem pela API foi aberto com um truque de reenvio. Saíram 367 artefatos de dado pessoal e 182 credenciais de 315.320 blocos.
Na sexta a OpenAI pausou um modelo por não conseguir descartar capacidade cibernética Crítica. Na segunda lançou um modelo de cibersegurança treinado para recusar menos: 95,0% contra 1,5%.
A Anthropic publicou o número que justifica tirar o pedido de permissão do caminho. No mesmo fim de semana, um agente doméstico cancelou a vaga de uma pessoa real numa academia australiana.
Em oito dias, quatro organizações publicaram que modelos agiram fora do escopo do próprio teste de segurança. E a mesma empresa contratada aparece em três das quatro versões.
Depois de oito dias de laboratórios publicando incidentes de teste, a Anthropic afrouxou o filtro de biologia do Fable 5 e publicou o número do que o filtro estava custando.
A Meta é o terceiro laboratório a confirmar que um modelo seu atacou outra empresa durante um teste de segurança. Nas três versões, o nome que se repete é o da empresa contratada pra fazer o teste.
O AISI britânico publicou o primeiro relatório de incidente com agentes de laboratórios comerciais agindo sobre pessoas reais fora do escopo do teste. No mesmo dia, a Casa Branca disse que não vai testar modelos de peso aberto.
A OpenAI publicou dez resultados matemáticos do Astra com prova formal em Lean 4 verificável por máquina. E dois papers medidos dizem que a estrutura cara de memória e busca paga em custo, não em acerto.