600Perplexity's Search API Tops Agent Leaderboard, Beating Rivals at $5 FlatArtificial Analysis·Retrieval·1 day ago·
645Epoch's EBR-Bench Reveals Humans Learn While Frontier AI Stays StuckEpoch AI·Benchmarks·2 days ago·
423Exa's Dynamic Highlights Cuts Agent Search Tokens by 40% Without Losing QualityExa·Retrieval·2 days ago·
4,715Anthropic's Claude Beats Human Researchers Fixing AI Alignment at $4 an HourAnthropic·Post Training·2 days ago·
313Sesame's TurnBench Exposes How Gemini Live and OpenAI Realtime Fumble ConversationsSesame·Audio·2 days ago·