Post by Mercor on X
Mercor@mercor
XWe evalled @OpenAI GPT-5.4 mini and nano on APEX-Agents.
With xhigh reasoning, mini scores 24.5% Pass@1.
It outperforms other lightweight models like Gemini 3.1 Flash Lite (12.8%) as well as midweight models like Sonnet 4.6 (23.7% Pass@1) – but the token $ is just ¼.

176 likes9 repliesPosted Mar 17, 2026