AI news & updates
1,070 events
- BenchmarkEpoch AI evaluates Claude Sonnet 4.6
SimpleQA Verified 32.8%
- BenchmarkEpoch AI evaluates Claude Opus 4.7 (xhigh)
SimpleQA Verified 51.7%
- BenchmarkEpoch AI evaluates Claude Opus 4.8
SimpleQA Verified 53.0%
- BenchmarkEpoch AI evaluates GPT-5.4 (low)
Mystery Game Puzzles 17.0%
- BenchmarkEpoch AI evaluates GPT-5.6 Sol (low)
Mystery Game Puzzles 26.0%
- BenchmarkEpoch AI evaluates MiniMax M3
Mystery Game Puzzles 7.0% · Mystery Game Puzzles 8.0%
- BenchmarkEpoch AI evaluates GPT-5.6 Terra (low)
Mystery Game Puzzles 19.0%
- BenchmarkEpoch AI evaluates GPT-5.1 (medium)
Mystery Game Puzzles 16.0%
- BenchmarkEpoch AI evaluates GPT-5 (medium)
Mystery Game Puzzles 15.0%
- BenchmarkEpoch AI evaluates GPT-5 Mini
Mystery Game Puzzles 5.0%
- BenchmarkEpoch AI evaluates GPT-5.6 Luna (medium)
Mystery Game Puzzles 12.0%
- BenchmarkEpoch AI evaluates Qwen3.6 27B
Mystery Game Puzzles 7.0%
- BenchmarkEpoch AI evaluates Qwen3.5 397B A17B
Mystery Game Puzzles 18.0%
- BenchmarkEpoch AI evaluates GPT-5.1 (low)
Mystery Game Puzzles 19.0%
- BenchmarkEpoch AI evaluates Qwen3.5-122B-A10B
Mystery Game Puzzles 17.0%
- BenchmarkEpoch AI evaluates GPT-5.4 mini (medium)
Mystery Game Puzzles 7.0%
- BenchmarkEpoch AI evaluates Qwen3.6 35B A3B
Mystery Game Puzzles 22.0%
- BenchmarkEpoch AI evaluates GPT-5.4 mini (low)
Mystery Game Puzzles 8.0%
- BenchmarkEpoch AI evaluates GPT-5.6 Luna (low)
Mystery Game Puzzles 17.0%
- BenchmarkEpoch AI evaluates Qwen3.7 Plus
Mystery Game Puzzles 17.0%
- BenchmarkEpoch AI evaluates Qwen3.7 Flash
Mystery Game Puzzles 14.0%
- BenchmarkEpoch AI evaluates GPT-5 mini (medium)
Mystery Game Puzzles 4.0%
- BenchmarkEpoch AI evaluates GPT-5 Nano
Mystery Game Puzzles 8.0%
- BenchmarkEpoch AI evaluates GPT-5.4 nano (medium)
Mystery Game Puzzles 6.0%
- BenchmarkEpoch AI evaluates GPT-5.6 Sol (none)
Mystery Game Puzzles 33.0%
- BenchmarkEpoch AI evaluates GPT-5.5 (no thinking)
Mystery Game Puzzles 18.0%
- BenchmarkEpoch AI evaluates gpt-oss-120b
Mystery Game Puzzles 0.0% · Mystery Game Puzzles 2.0%
- BenchmarkEpoch AI evaluates GPT-5.2 (none)
Mystery Game Puzzles 14.0%
- BenchmarkEpoch AI evaluates DeepSeek v4 Pro (unknown thinking)
Mystery Game Puzzles 17.0%
- BenchmarkEpoch AI evaluates GPT-5.4 nano (low)
Mystery Game Puzzles 3.0%
- BenchmarkEpoch AI evaluates Nemotron 3 Ultra
Mystery Game Puzzles 20.0%
- BenchmarkEpoch AI evaluates GPT-5.6 Terra (none)
Mystery Game Puzzles 14.0%
- BenchmarkEpoch AI evaluates GPT-5 nano (medium)
Mystery Game Puzzles 9.0%
- BenchmarkEpoch AI evaluates GPT-5.1 (no thinking)
Mystery Game Puzzles 15.0%
- BenchmarkEpoch AI evaluates GPT-5.4 mini (none)
Mystery Game Puzzles 11.0%
- BenchmarkEpoch AI evaluates GPT-5.4 nano (no thinking)
Mystery Game Puzzles 9.0%
- AnnouncementIntelligent transcription with Gemini 3.5 Transcribe
Now you can get more intelligent speech-to-text transcription with Gemini 3.5 Transcribe.
- Open releaseMajorQwen releases Qwen3.8 Flash
Qwen3.8 Flash is a multimodal reasoning model from Alibaba. It is suited for coding assistance, agentic workflows, visual understanding, document and codebase analysis, desktop interaction, chart analysis, and long-video
- Open releaseZ.ai releases GLM 5.3 Flash (batch)
GLM-5.3-Flash is a native multimodal model from Z.ai. It is suited for efficient coding and long-horizon agent tasks. Its hybrid sparse and linear attention architecture maintains accurate long-context behavior while...
- BenchmarkEpoch AI evaluates GLM 5.3 Flash
GPQA diamond 90.2% · OTIS Mock AIME 2024-2025 93.9% · Chess Puzzles 14.0%