614Perplexity's Search API Tops Agent Leaderboard, Beating Rivals at $5 FlatArtificial Analysis·Retrieval·2 days ago·
652Epoch's EBR-Bench Reveals Humans Learn While Frontier AI Stays StuckEpoch AI·Benchmarks·2 days ago·
424Exa's Dynamic Highlights Cuts Agent Search Tokens by 40% Without Losing QualityExa·Retrieval·2 days ago·
4,775Anthropic's Claude Beats Human Researchers Fixing AI Alignment at $4 an HourAnthropic·Post Training·2 days ago·
318Sesame's TurnBench Exposes How Gemini Live and OpenAI Realtime Fumble ConversationsSesame·Audio·2 days ago·