Hermes推出大模型性能与成本双维榜单

IT时代网10月7日消息,Hermes开发商Nous Research推出Hermes Index榜单,评估维度除性能水平外还纳入每任务成本,性能指数越高、任务成本越低排名越优。目前Opus 5.5位列第一,每任务成本4.99美元;GPT-6 Astra位列第二,每任务成本达11.61美元,是所列十几款大模型中最贵的一档。

榜单前列以Anthropic与OpenAI两家的模型为主;国产大模型中排名最高的是GLM-5.3,位列第六,其余八个名次也基本由国产大模型占据。DeepSeek V4.1 Flash名次不算靠前,但每任务成本仅0.259美元,较前排模型直接低了一个档次。

性价比方面,GPT-6 Luna的每任务成本约为V4.1 Flash的一半多一点,性能也非常接近;成本最低的是蚂蚁集团Ling 3.0 Flash,每任务低至0.054美元,不过性能分数也低了不少,该模型在Hermes账户内可免费使用但每日额度有限。最新的Ling 3.1 Flash跑分已超过V4.1 Flash,官网提供一定免费期。

注:本文中包含AI辅助创作的内容。

编辑:林一舟

THE END