Post by Paul Gauthier on X
Paul Gauthier@paulgauthier
XThe new Qwen 2.5 Coder models did very well on aider's code editing benchmark. The 32B Instruct model scored in between GPT-4o and 3.5 Haiku.
84% 3.5 Sonnet
75% 3.5 Haiku
74% Qwen2.5 Coder 32B
71% GPT-4o
69% Qwen2.5 Coder 14B
58% Qwen2.5 Coder 7B
t.co

447 likes18 repliesPosted Nov 11, 2024