人工智能评测:大模型能力差异显著
2026-08-05 13:52:22
币界网消息,人工智能评测机构artificial analysis发布了API准确率榜单,测试同一开源模型在不同云服务商下的能力保留情况。首批测试包括glm-5.2、gpt-oss-120b和deepseek v4 pro,覆盖44个API端点。结果显示,glm-5.2最差端点仅有52%的能力保留,gpt-oss-120b得分在70%至101%之间,而deepseek v4 pro在9家服务商中均保持在97%至107%之间,官方API得分最高。差距主要源于量化、输出长度、推理配置和工具调用处理。
利好 0
利空 0
来源:互联网
本内容只为提供市场信息,不构成投资建议。
热门文章