排名模型 / 厂商最擅长上线日期评测配置输入输出AIdaily 能力分
01
日常分析和复杂推理都比较突出
上线日期2026-09-04
评测配置max
输入$10
输出$50
94.0
四支柱证据完整度: 23/23 tasks · 7/7 categories · 4/4 pillars
- 通用能力
- 82.66
- 科学与复杂推理
- 94.73
- 编程
- 80.36
- Agent / 真实编程任务
- 57.32
官方页面LiveBench 原始数据
02
日常分析、推理、写代码和真实任务比较均衡
上线日期2026-09-01
评测配置max
输入$10
输出$50
93.9
四支柱证据完整度: 23/23 tasks · 7/7 categories · 4/4 pillars
- 通用能力
- 80.92
- 科学与复杂推理
- 94.35
- 编程
- 86.38
- Agent / 真实编程任务
- 66.06
官方页面LiveBench 原始数据
03
理解需求和写代码都比较突出
上线日期2026-06-09
评测配置max
输入$10
输出$50
93.2
四支柱证据完整度: 23/23 tasks · 7/7 categories · 4/4 pillars
- 通用能力
- 82.33
- 科学与复杂推理
- 92.82
- 编程
- 85.99
- Agent / 真实编程任务
- 62.17
官方页面LiveBench 原始数据
04
复杂推理和真实代码任务都比较突出
上线日期2026-07-24
评测配置max
输入$5
输出$25
93.1
四支柱证据完整度: 23/23 tasks · 7/7 categories · 4/4 pillars
- 通用能力
- 75.67
- 科学与复杂推理
- 93.47
- 编程
- 81.45
- Agent / 真实编程任务
- 65.20
官方页面LiveBench 原始数据
05
更擅长整理信息、理解指令和完成日常分析
上线日期2026-09-02
评测配置xhigh
输入$1.25
输出$4.25
90.9
四支柱证据完整度: 23/23 tasks · 7/7 categories · 4/4 pillars
- 通用能力
- 80.12
- 科学与复杂推理
- 92.80
- 编程
- 81.06
- Agent / 真实编程任务
- 64.09
官方页面LiveBench 原始数据
06
复杂推理和写代码都比较突出
上线日期2026-07-09
评测配置max
输入$5
输出$30
88.7
四支柱证据完整度: 23/23 tasks · 7/7 categories · 4/4 pillars
- 通用能力
- 79.79
- 科学与复杂推理
- 93.93
- 编程
- 83.94
- Agent / 真实编程任务
- 56.21
官方页面LiveBench 原始数据
07
更擅长在真实代码仓库里连续修改并解决问题
上线日期2026-08-18
评测配置default
输入$1.4
输出$4.4
85.8
四支柱证据完整度: 23/23 tasks · 7/7 categories · 4/4 pillars
- 通用能力
- 73.13
- 科学与复杂推理
- 86.85
- 编程
- 78.95
- Agent / 真实编程任务
- 60.91
官方页面LiveBench 原始数据
08
更擅长数学、科学问题和多步复杂推理
上线日期2026-08-12
评测配置default
输入$2
输出$6
84.1
四支柱证据完整度: 23/23 tasks · 7/7 categories · 4/4 pillars
- 通用能力
- 76.47
- 科学与复杂推理
- 91.54
- 编程
- 76.78
- Agent / 真实编程任务
- 57.02
官方页面LiveBench 原始数据
09
复杂推理和写代码都比较突出
上线日期2026-09-22
评测配置max
输入$4
输出$20
83.3
四支柱证据完整度: 23/23 tasks · 7/7 categories · 4/4 pillars
- 通用能力
- 77.44
- 科学与复杂推理
- 94.62
- 编程
- 89.25
- Agent / 真实编程任务
- 71.72
官方页面LiveBench 原始数据
10
更擅长整理信息、理解指令和完成日常分析
上线日期2026-07-16
评测配置default
输入$3
输出$15
83.1
四支柱证据完整度: 23/23 tasks · 7/7 categories · 4/4 pillars
- 通用能力
- 78.54
- 科学与复杂推理
- 87.55
- 编程
- 81.45
- Agent / 真实编程任务
- 62.17
官方页面LiveBench 原始数据
11
写代码和处理真实代码仓库都比较突出
上线日期2026-09-22
评测配置xhigh
输入$4
输出$20
81.4
四支柱证据完整度: 23/23 tasks · 7/7 categories · 4/4 pillars
- 通用能力
- 77.45
- 科学与复杂推理
- 93.73
- 编程
- 89.25
- Agent / 真实编程任务
- 65.35
官方页面LiveBench 原始数据
12
更擅长数学、科学问题和多步复杂推理
上线日期2026-07-09
评测配置max
输入$2.5
输出$15
80.5
四支柱证据完整度: 23/23 tasks · 7/7 categories · 4/4 pillars
- 通用能力
- 75.61
- 科学与复杂推理
- 92.77
- 编程
- 78.25
- Agent / 真实编程任务
- 54.95
官方页面LiveBench 原始数据
13
复杂推理和写代码都比较突出
上线日期2026-04-16
评测配置max
输入$5
输出$25
78.8
四支柱证据完整度: 23/23 tasks · 7/7 categories · 4/4 pillars
- 通用能力
- 72.58
- 科学与复杂推理
- 91.75
- 编程
- 81.83
- Agent / 真实编程任务
- 50.50
官方页面LiveBench 原始数据
14
更擅长数学、科学问题和多步复杂推理
上线日期2026-09-02
评测配置high
输入$0.75
输出$3.75
78.1
四支柱证据完整度: 23/23 tasks · 7/7 categories · 4/4 pillars
- 通用能力
- 74.40
- 科学与复杂推理
- 90.43
- 编程
- 72.49
- Agent / 真实编程任务
- 54.24
官方页面LiveBench 原始数据
15
更擅长在真实代码仓库里连续修改并解决问题
上线日期2026-08-26
评测配置default
输入$0.15
输出$0.5
76.9
四支柱证据完整度: 23/23 tasks · 7/7 categories · 4/4 pillars
- 通用能力
- 68.84
- 科学与复杂推理
- 79.44
- 编程
- 78.95
- Agent / 真实编程任务
- 56.77
官方页面LiveBench 原始数据
16
日常分析和复杂推理都比较突出
上线日期2026-09-22
评测配置max
输入$2
输出$10
76.4
四支柱证据完整度: 23/23 tasks · 7/7 categories · 4/4 pillars
- 通用能力
- 78.35
- 科学与复杂推理
- 92.50
- 编程
- 81.77
- Agent / 真实编程任务
- 52.88
官方页面LiveBench 原始数据
17
更擅长写出正确代码和补全程序
上线日期2026-04-16
评测配置xhigh
输入$5
输出$25
75.9
四支柱证据完整度: 23/23 tasks · 7/7 categories · 4/4 pillars
- 通用能力
- 74.31
- 科学与复杂推理
- 90.02
- 编程
- 82.09
- Agent / 真实编程任务
- 50.66
官方页面LiveBench 原始数据
18
更擅长写出正确代码和补全程序
上线日期2026-09-16
评测配置default
输入$0
输出$0
74.6
四支柱证据完整度: 23/23 tasks · 7/7 categories · 4/4 pillars
- 通用能力
- 73.34
- 科学与复杂推理
- 88.02
- 编程
- 82.15
- Agent / 真实编程任务
- 54.70
官方页面LiveBench 原始数据
19
更擅长整理信息、理解指令和完成日常分析
上线日期2026-09-21
评测配置xhigh
输入$2
输出$6
74.4
四支柱证据完整度: 23/23 tasks · 7/7 categories · 4/4 pillars
- 通用能力
- 77.43
- 科学与复杂推理
- 89.17
- 编程
- 77.16
- Agent / 真实编程任务
- 53.99
官方页面LiveBench 原始数据
20
更擅长在真实代码仓库里连续修改并解决问题
上线日期2026-07-19
评测配置max
输入$2
输出$6
73.6
四支柱证据完整度: 23/23 tasks · 7/7 categories · 4/4 pillars
- 通用能力
- 77.39
- 科学与复杂推理
- 89.76
- 编程
- 72.87
- Agent / 真实编程任务
- 64.65
官方页面LiveBench 原始数据
21
更擅长写出正确代码和补全程序
上线日期2026-09-22
评测配置max
输入$0.1
输出$0.5
70.8
四支柱证据完整度: 23/23 tasks · 7/7 categories · 4/4 pillars
- 通用能力
- 67.71
- 科学与复杂推理
- 85.45
- 编程
- 78.95
- Agent / 真实编程任务
- 51.21
官方页面LiveBench 原始数据
22
更擅长在真实代码仓库里连续修改并解决问题
上线日期2026-09-10
评测配置max
输入$0.15
输出$0.6
66.7
四支柱证据完整度: 23/23 tasks · 7/7 categories · 4/4 pillars
- 通用能力
- 76.83
- 科学与复杂推理
- 89.99
- 编程
- 80.04
- Agent / 真实编程任务
- 77.27
官方页面LiveBench 原始数据
23
更擅长整理信息、理解指令和完成日常分析
上线日期2026-08-13
评测配置high
输入$0.75
输出$3.75
64.9
四支柱证据完整度: 23/23 tasks · 7/7 categories · 4/4 pillars
- 通用能力
- 77.78
- 科学与复杂推理
- 90.63
- 编程
- 78.89
- Agent / 真实编程任务
- 58.28
官方页面LiveBench 原始数据
24
理解需求和处理真实代码任务都比较突出
上线日期待核实
评测配置default
输入$2
输出$6
58.9
四支柱证据完整度: 23/23 tasks · 7/7 categories · 4/4 pillars
- 通用能力
- 75.79
- 科学与复杂推理
- 89.00
- 编程
- 68.59
- Agent / 真实编程任务
- 56.46
官方页面LiveBench 原始数据
25
更擅长整理信息、理解指令和完成日常分析
上线日期2026-04-23
评测配置xhigh
输入$5
输出$30
58.4
四支柱证据完整度: 23/23 tasks · 7/7 categories · 4/4 pillars
- 通用能力
- 79.89
- 科学与复杂推理
- 92.76
- 编程
- 82.15
- Agent / 真实编程任务
- 53.99
官方页面LiveBench 原始数据
26
日常分析和复杂推理都比较突出
上线日期2026-03-05
评测配置xhigh
输入$2.5
输出$15
58.0
四支柱证据完整度: 23/23 tasks · 7/7 categories · 4/4 pillars
- 通用能力
- 77.39
- 科学与复杂推理
- 91.13
- 编程
- 77.54
- Agent / 真实编程任务
- 53.84
官方页面LiveBench 原始数据
27
更擅长写出正确代码和补全程序
上线日期待核实
评测配置default
输入$1.4
输出$4.4
54.4
四支柱证据完整度: 23/23 tasks · 7/7 categories · 4/4 pillars
- 通用能力
- 70.76
- 科学与复杂推理
- 84.20
- 编程
- 79.65
- Agent / 真实编程任务
- 51.77
官方页面LiveBench 原始数据
28
复杂推理和真实代码任务都比较突出
上线日期待核实
评测配置xhigh
输入$3
输出$15
52.8
四支柱证据完整度: 23/23 tasks · 7/7 categories · 4/4 pillars
- 通用能力
- 70.19
- 科学与复杂推理
- 90.82
- 编程
- 80.68
- Agent / 真实编程任务
- 59.39
官方页面LiveBench 原始数据
29
更擅长写出正确代码和补全程序
上线日期2026-07-09
评测配置max
输入$1
输出$6
49.7
四支柱证据完整度: 23/23 tasks · 7/7 categories · 4/4 pillars
- 通用能力
- 70.24
- 科学与复杂推理
- 86.42
- 编程
- 82.91
- Agent / 真实编程任务
- 48.43
官方页面LiveBench 原始数据
30
更擅长数学、科学问题和多步复杂推理
上线日期2026-08-13
评测配置default
输入$0.435
输出$0.87
49.0
四支柱证据完整度: 23/23 tasks · 7/7 categories · 4/4 pillars
- 通用能力
- 76.34
- 科学与复杂推理
- 90.46
- 编程
- 77.16
- Agent / 真实编程任务
- 54.95
官方页面LiveBench 原始数据
同一厂商可以保留多款当前主力,避免只看一款就误判整个品牌。
更擅长写出正确代码和补全程序
可用性公开 API阶段稳定接入api价格$0.5 / $3来源
更擅长整理信息、理解指令和完成日常分析
可用性公开 API阶段稳定接入api价格$2.5 / $7.5来源
更擅长在真实代码仓库里连续修改并解决问题
可用性开放权重阶段稳定接入weights价格$0.265 / $0.65来源
更擅长在真实代码仓库里连续修改并解决问题
可用性开放权重阶段稳定接入weights价格$2 / $6来源
更擅长写出正确代码和补全程序
可用性开放权重阶段稳定接入api, weights价格$0.6 / $3.6来源
当前无法公开使用,不参加正式排行
可用性开放权重阶段预览接入api, open_weights, web价格$0.16 / $0.47来源
复杂推理和写代码都比较突出
可用性公开 API阶段稳定接入chat, api价格$4 / $20来源
写代码和处理真实代码仓库都比较突出
可用性公开 API阶段稳定接入chat, api价格$4 / $20来源
日常分析、推理、写代码和真实任务比较均衡
可用性公开 API阶段稳定接入public_api, consumer价格$10 / $50来源
复杂推理和真实代码任务都比较突出
可用性公开 API阶段稳定接入api价格$5 / $25来源
理解需求和写代码都比较突出
可用性公开 API阶段稳定接入api价格$10 / $50来源
更擅长写出正确代码和补全程序
可用性公开 API阶段稳定接入api价格$5 / $25来源
复杂推理和写代码都比较突出
可用性公开 API阶段稳定接入api价格$5 / $25来源
更擅长写出正确代码和补全程序
可用性公开 API阶段稳定接入api价格$3 / $15来源
更擅长数学、科学问题和多步复杂推理
可用性公开 API阶段稳定接入api价格$5 / $25来源
更擅长写出正确代码和补全程序
可用性公开 API阶段稳定接入api价格$5 / $25来源
复杂推理和真实代码任务都比较突出
可用性公开 API阶段稳定接入api价格$3 / $15来源
适合中文写作、问答和需要长时间推理的任务
可用性普通用户可用阶段稳定接入consumer价格待核实来源
更擅长在真实代码仓库里连续修改并解决问题
可用性公开 API阶段试验接入api价格$0.22 / $0.66来源
更擅长在真实代码仓库里连续修改并解决问题
可用性开放权重阶段稳定接入api, open_weights价格$0.15 / $0.6来源
更擅长数学、科学问题和多步复杂推理
可用性开放权重阶段稳定接入api, weights价格$0.435 / $0.87来源
更擅长整理信息、理解指令和完成日常分析
可用性开放权重阶段稳定接入api, weights价格$0.14 / $0.28来源
更擅长数学、科学问题和多步复杂推理
可用性开放权重阶段稳定接入api, weights价格$0.435 / $0.87来源
日常分析、推理、写代码和真实任务比较均衡
可用性开放权重阶段稳定接入api, weights价格$0.14 / $0.28来源
更擅长数学、科学问题和多步复杂推理
可用性公开 API阶段稳定接入api, consumer价格$0.75 / $3.75来源
更擅长整理信息、理解指令和完成日常分析
可用性公开 API阶段稳定接入api价格$0.75 / $3.75来源
更擅长整理信息、理解指令和完成日常分析
可用性公开 API阶段稳定接入api价格$1.5 / $9来源
更擅长写出正确代码和补全程序
可用性公开 API阶段稳定接入api价格$0.3 / $2.5来源
理解需求和写代码都比较突出
可用性公开 API阶段稳定接入api价格$1.5 / $7.5来源
当前无法公开使用,不参加正式排行
可用性公开 API阶段预览接入api价格$2 / $12来源
更擅长整理信息、理解指令和完成日常分析
可用性公开 API阶段稳定接入api价格$1.25 / $4.25来源
当前无法公开使用,不参加正式排行
可用性公开 API阶段预览接入api, consumer价格$1.25 / $4.25来源
当前无法公开使用,不参加正式排行
可用性公开 API阶段预览接入api, consumer价格$1.25 / $4.25来源
更擅长整理信息、理解指令和完成日常分析
可用性公开 API阶段稳定接入api价格$0.3 / $1.2来源
适合需要欧洲部署选择的代码和企业智能体任务
可用性普通用户可用阶段稳定接入consumer价格待核实来源
更擅长整理信息、理解指令和完成日常分析
可用性开放权重阶段稳定接入api, weights价格$3 / $15来源
更擅长写出正确代码和补全程序
可用性开放权重阶段稳定接入api, weights价格$0.95 / $4来源
写代码和处理真实代码仓库都比较突出
可用性开放权重阶段稳定接入api, weights价格$0.95 / $4来源
更擅长写出正确代码和补全程序
可用性公开 API阶段稳定接入chat, api价格$0.1 / $0.5来源
日常分析和复杂推理都比较突出
可用性公开 API阶段稳定接入chat, api价格$2 / $10来源
日常分析和复杂推理都比较突出
可用性公开 API阶段稳定接入chat, api价格$10 / $50来源
更擅长写出正确代码和补全程序
可用性公开 API阶段稳定接入api价格$1 / $6来源
复杂推理和写代码都比较突出
可用性公开 API阶段稳定接入api价格$5 / $30来源
更擅长数学、科学问题和多步复杂推理
可用性公开 API阶段稳定接入api价格$2.5 / $15来源
更擅长整理信息、理解指令和完成日常分析
可用性公开 API阶段稳定接入api价格$5 / $30来源
更擅长写出正确代码和补全程序
可用性公开 API阶段稳定接入api价格$0.75 / $4.5来源
更擅长数学、科学问题和多步复杂推理
可用性公开 API阶段稳定接入api价格$0.2 / $1.25来源
日常分析和复杂推理都比较突出
可用性公开 API阶段稳定接入api价格$2.5 / $15来源
更擅长写出正确代码和补全程序
可用性公开 API阶段稳定接入api价格$1.75 / $14来源
更擅长数学、科学问题和多步复杂推理
可用性公开 API阶段稳定接入api价格$1.75 / $14来源
适合在腾讯云里处理中文任务和智能体工作
可用性普通用户可用阶段稳定接入consumer价格待核实来源
理解需求和处理真实代码任务都比较突出
可用性开放权重阶段稳定接入weights价格$1.87 / $4.68来源
更擅长整理信息、理解指令和完成日常分析
可用性公开 API阶段稳定接入api价格$2 / $6来源
更擅长数学、科学问题和多步复杂推理
可用性公开 API阶段稳定接入api价格$2 / $6来源
日常分析、推理、写代码和真实任务比较均衡
可用性公开 API阶段稳定接入api价格$1.25 / $2.5来源
理解需求和处理真实代码任务都比较突出
可用性公开 API阶段稳定接入api价格$2 / $6来源
理解需求和处理真实代码任务都比较突出
可用性公开 API阶段稳定接入api价格$1 / $2来源
更擅长在真实代码仓库里连续修改并解决问题
可用性开放权重阶段稳定接入api, open_weights, web价格$0.15 / $0.5来源
更擅长在真实代码仓库里连续修改并解决问题
可用性开放权重阶段稳定接入api价格$1.4 / $4.4来源
更擅长写出正确代码和补全程序
可用性开放权重阶段稳定接入api, weights价格$1.4 / $4.4来源
理解需求和处理真实代码任务都比较突出
可用性公开 API阶段稳定接入api, consumer价格$3 / $15来源
更擅长在真实代码仓库里连续修改并解决问题
可用性开放权重阶段稳定接入open_weights, api价格$0.14 / $0.28来源
更擅长在真实代码仓库里连续修改并解决问题
可用性开放权重阶段稳定接入open_weights, api价格$0.265 / $0.65来源
更擅长写出正确代码和补全程序
可用性公开 API阶段试验接入api价格$0 / $0来源
更擅长在真实代码仓库里连续修改并解决问题
可用性公开 API阶段试验接入api价格$0 / $0来源
更擅长数学、科学问题和多步复杂推理
可用性开放权重阶段稳定接入api, weights价格$0.6 / $2.4来源
只推荐普通用户或公开 API 可用的型号,按真实用途给出选择线索。
综合能力
日常分析和复杂推理都比较突出
可用性公开 API阶段稳定接入chat, api价格$10 / $50来源
日常分析、推理、写代码和真实任务比较均衡
可用性公开 API阶段稳定接入public_api, consumer价格$10 / $50来源
理解需求和写代码都比较突出
可用性公开 API阶段稳定接入api价格$10 / $50来源
编程与真实任务
复杂推理和写代码都比较突出
可用性公开 API阶段稳定接入chat, api价格$4 / $20来源
更擅长在真实代码仓库里连续修改并解决问题
可用性开放权重阶段稳定接入api, open_weights价格$0.15 / $0.6来源
写代码和处理真实代码仓库都比较突出
可用性公开 API阶段稳定接入chat, api价格$4 / $20来源
复杂推理
日常分析和复杂推理都比较突出
可用性公开 API阶段稳定接入chat, api价格$10 / $50来源
复杂推理和写代码都比较突出
可用性公开 API阶段稳定接入chat, api价格$4 / $20来源
日常分析、推理、写代码和真实任务比较均衡
可用性公开 API阶段稳定接入public_api, consumer价格$10 / $50来源
价格友好
更擅长数学、科学问题和多步复杂推理
可用性公开 API阶段稳定接入api, consumer价格$0.75 / $3.75来源
更擅长整理信息、理解指令和完成日常分析
可用性公开 API阶段稳定接入api价格$1.25 / $4.25来源
更擅长数学、科学问题和多步复杂推理
可用性公开 API阶段稳定接入api价格$2 / $6来源
开放权重
更擅长在真实代码仓库里连续修改并解决问题
可用性开放权重阶段稳定接入api价格$1.4 / $4.4来源
更擅长整理信息、理解指令和完成日常分析
可用性开放权重阶段稳定接入api, weights价格$3 / $15来源
更擅长在真实代码仓库里连续修改并解决问题
可用性开放权重阶段稳定接入api, open_weights, web价格$0.15 / $0.5来源
暂无同口径能力排行。这里展示厂商公开的专项模型,不把不同模态硬凑成一个总分。
适合批量生成和编辑速度快、成本低的图片
可用性普通用户可用阶段稳定接入consumer价格待核实来源
适合把详细文字要求变成可继续编辑的成品图
可用性普通用户可用阶段稳定接入consumer价格待核实来源
适合做出风格更大胆、质量更稳定且更懂个人审美的图片
可用性普通用户可用阶段稳定接入consumer价格待核实来源
适合需要先理解画面再生成或编辑的复杂图片任务
可用性普通用户可用阶段稳定接入consumer价格待核实来源
同一厂商可以保留多款当前主力,避免只看一款就误判整个品牌。
适合需要先理解画面再生成或编辑的复杂图片任务
可用性普通用户可用阶段稳定接入consumer价格待核实来源
适合批量生成和编辑速度快、成本低的图片
可用性普通用户可用阶段稳定接入consumer价格待核实来源
适合做出风格更大胆、质量更稳定且更懂个人审美的图片
可用性普通用户可用阶段稳定接入consumer价格待核实来源
适合把详细文字要求变成可继续编辑的成品图
可用性普通用户可用阶段稳定接入consumer价格待核实来源
只推荐普通用户或公开 API 可用的型号,按真实用途给出选择线索。
本期新款 / 当前主力
适合做出风格更大胆、质量更稳定且更懂个人审美的图片
可用性普通用户可用阶段稳定接入consumer价格待核实来源
适合批量生成和编辑速度快、成本低的图片
可用性普通用户可用阶段稳定接入consumer价格待核实来源
适合需要先理解画面再生成或编辑的复杂图片任务
可用性普通用户可用阶段稳定接入consumer价格待核实来源
暂无同口径能力排行。这里展示厂商公开的专项模型,不把不同模态硬凑成一个总分。
适合用分镜控制动作连贯、带声音的多镜头视频
可用性普通用户可用阶段稳定接入consumer价格待核实来源
适合需要人物动作、表情和物理效果稳定的视频
可用性普通用户可用阶段稳定接入consumer价格待核实来源
单次生成 30 秒音视频并可连续扩展,适合多镜头成片控制
可用性普通用户可用阶段稳定接入consumer价格待核实来源
适合做带原生声音和精细镜头控制的电影感视频
同一厂商可以保留多款当前主力,避免只看一款就误判整个品牌。
单次生成 30 秒音视频并可连续扩展,适合多镜头成片控制
可用性普通用户可用阶段稳定接入consumer价格待核实来源
适合做带原生声音和精细镜头控制的电影感视频
适合用分镜控制动作连贯、带声音的多镜头视频
可用性普通用户可用阶段稳定接入consumer价格待核实来源
适合需要人物动作、表情和物理效果稳定的视频
可用性普通用户可用阶段稳定接入consumer价格待核实来源
只推荐普通用户或公开 API 可用的型号,按真实用途给出选择线索。
本期新款 / 当前主力
单次生成 30 秒音视频并可连续扩展,适合多镜头成片控制
可用性普通用户可用阶段稳定接入consumer价格待核实来源
适合用分镜控制动作连贯、带声音的多镜头视频
可用性普通用户可用阶段稳定接入consumer价格待核实来源
适合需要人物动作、表情和物理效果稳定的视频
可用性普通用户可用阶段稳定接入consumer价格待核实来源
暂无同口径能力排行。这里展示厂商公开的专项模型,不把不同模态硬凑成一个总分。
适合情绪丰富的配音和多语言表达
可用性普通用户可用阶段稳定接入consumer价格待核实来源
适合多人对话和更细的语气控制
适合需要低延迟对话、工具调用和语音推理的应用
可用性普通用户可用阶段稳定接入api价格待核实来源
同一厂商可以保留多款当前主力,避免只看一款就误判整个品牌。
适合情绪丰富的配音和多语言表达
可用性普通用户可用阶段稳定接入consumer价格待核实来源
适合需要低延迟对话、工具调用和语音推理的应用
可用性普通用户可用阶段稳定接入api价格待核实来源
只推荐普通用户或公开 API 可用的型号,按真实用途给出选择线索。
本期新款 / 当前主力
适合情绪丰富的配音和多语言表达
可用性普通用户可用阶段稳定接入consumer价格待核实来源
适合需要低延迟对话、工具调用和语音推理的应用
可用性普通用户可用阶段稳定接入api价格待核实来源
AIHOT 大模型共识能力排行 · AIHOT Consensus v1
汇总全网 7 家独立评测机构的 9 张权威榜单,用固定问题预算计算 AIHOT 共识分,直观呈现主流大模型的综合能力。
综合评测 30% + 真人盲选 10% + 专项评测 60%(编程设计 12% + 数学推理 12% + 写作表达 9% + 知识事实 6% + 视觉理解 6% + 工具办公 6% + 中文多语言 6% + 行业专业 3%)
只在具备至少 3 个独立证据家族和冻结锚点之间评估共识;缺榜只降低评测完整度与确定性,不直接扣分,也不把空缺权重转给别榜。