Post by Ethan Mollick on X
Ethan Mollick@emollick
XTesting Kimi K-2 has reminded me of how insane it is that firms picking AIs are treating them as fungible based on benchmarks
Kimi & Grok & Claude & every other model have strengths, quirks & weaknesses that can make a big difference in aggregate
Develop your own benchmarks!
509 likes26 repliesPosted Nov 7, 2025