大模型评测对比
重要提示
本页评测结果仅代表当时测试时的表现,仅用作当时参考。
大模型发展速度飞快,模型版本迭代频繁。本页所列结果均产生于表格中的「测试日期」当时,随着时间推移,同一模型的新版本或当下新发布的大模型,其效果往往会有进一步提升。因此,本页结果更适合作为历史参考,而非对当前或未来模型表现的定论。
本页汇总不同大模型在 Data Agent 中的评测结果。
评测维度
- 数据问答表现(Nora)
- 深度代理表现(deepagent)
- AI建模表现(sage)
评测结果
说明
- 本页仅用于横向对比不同模型在当时的整体表现。
- 大模型发展速度飞快,本页结果仅用作当时参考,不宜直接作为对当前或未来模型效果的评判。
- 评测结果会随着产品能力、测试用例和模型版本变化而调整。
- 如需查看详细原因与测试现象,请前往完整评测页面。

