Robô vê uma demonstração e taxa de sucesso chega a 59%
A Generalist AI mostra, com o GEN-1.5, como um robô aprende uma tarefa nova a partir de uma única demonstração no contexto, sem ajustar nenhum parâmetro.
A Generalist AI mostra, com o GEN-1.5, como um robô aprende uma tarefa nova a partir de uma única demonstração no contexto, sem ajustar nenhum parâmetro.
O Pew Research analisou 490 mil páginas em inglês de 49 snapshots do Common Crawl: 10% mostram sinais de escrita por IA, percentual que sobe a 35% nas páginas surgidas após o ChatGPT.
SGLang e Ant Group reduzem a latência por token do Ling-3.0-flash com concorrência 1 em até 77% em quatro GPUs Blackwell.
Por três meses, a OpenAI reduz os preços de API do GPT-5.6 Sol: entrada cai 20%, saída cai um terço, enquanto as assinaturas Pro, Plus e Business permanecem no mesmo valor.
Ant, Alibaba e a equipe do SGLang mantêm os pesos quantizados na memória da GPU e reduzem o reinício de um modelo de um trilhão de parâmetros de 8,8 minutos para 32 segundos.
A Anthropic está integrando o Claude Mythos 5 a produtos de segurança de parceiros, colocando-o para rodar as varreduras do Claude Security e destinando US$ 35 milhões em créditos à segurança de código aberto.
Anthropic torna público o ciclo de vida de desenvolvimento de software AI-native usado internamente em torno do Claude, com seis fases, uma cadeia de arquivos markdown e quatro peças de governança.
A OpenBMB lançou em código aberto o MathForm, um modelo de 8B que traduz matemática para Lean 4 e supera modelos de formalização de 32B no teste mais difícil, o FATE-X.
Teste da Hume AI com 11 modelos de ASR mostra que a menor taxa de erro costuma coincidir com a maior taxa de reprodução de erros do texto de referência, um alerta para quem escolhe modelos de voz em produção.
Pesquisador encontra bucket S3 desprotegido da ClarityCheck com 9,04 milhões de fotos de rostos; empresa nega que isso seja uma exposição pública.