本地模型又迎来一个挑战者:Ornith-1.5

简单汇总下评测数据,并和 Qwen3.8-27B 做个对比

@Alibaba_Qwen 学学人家,一开始就放出了 35B-A3B,你再不出,我可要叛逃到 Ornith 了🤓 https://twitter.com/ornith_/status/2090074077084127302

tweet-2090231764103135585-f0cd3db5.jpg

简单评测了下,依旧是围绕 nmem 的记忆整理进行,结果如图2

比qwen 3.6-35b-a3b 聪明,但输出不稳定,指令遵循不稳定,还是不能生产用

tweet-2090244557778911673-af02482b.jpg