GPT-5.6 Sol calibrou qubits no MIT: 40 medições, só 4 precisaram de ajuda humanapor ThiagoInteligência Artificial, Modelos e LLMs
O que 80 rodadas de teste revelam sobre agentes de IA e cobertura de bugspor ThiagoAgentes de IA, Inteligência Artificial
Engrim: memória local pra agentes de código não perderem contexto entre Claude Code, Cursor e Copilot CLIpor ThiagoFerramentas de IA, Inteligência Artificial
HydraFusion do GitHub: 67% mais barato que Opus 5 (com números reais de 3 benchmarks)por ThiagoFerramentas de IA, Inteligência Artificial
Como o Portal do Spotify realmente corta 90% dos tokens do Claude Code (não é o que você imagina)por ThiagoIA na Programação, Inteligência Artificial
Stripe, Neon, S3: o que 16.893 sessões revelam sobre qual serviço os agentes de IA escolhempor ThiagoAgentes de IA, Inteligência Artificial
RTK, compressor seletivo e mais: os números reais por trás da economia de tokens do Copilotpor ThiagoInteligência Artificial, Modelos e LLMs
ARC-AGI-1: 44% com um transformer treinado do zero por 67 centavos de dólarpor ThiagoInteligência Artificial, Modelos e LLMs
Lemmalog: memória de LLM baseada em Datalog faz 0,463 de F1 no LongMemEval com 2.700 tokenspor ThiagoInteligência Artificial, Modelos e LLMs
Model Hardware Standard da Anthropic: padrão para agentes de IA operarem equipamentos de laboratóriopor ThiagoInteligência Artificial, Modelos e LLMs
Avaliar LLMs antes de ir para produção: o ciclo do GitHub que cortou 95% dos falsos positivospor ThiagoIA na Programação, Inteligência Artificial
Rust Glancer: LSP alternativo ao rust-analyzer que mira menos de 100 MB de RAMpor ThiagoPerformance e Ferramentas do Dev, Programação