MiniMax全面深度评测 – 从语音合成到视频生成,中国全模态AI独角兽的崛起

AI工具评测1个月前发布 qiyanjin
23 0

# MiniMax 深度评测:从语音合成到视频生成,这家中国AI独角兽凭什么挑战全球巨头?

## 引言

2026年的AI大模型战场,已经不再是OpenAI一家独大的格局。在中国,一批技术实力雄厚的AI公司正在以惊人的速度崛起,而MiniMax无疑是其中最引人注目的玩家之一。这家成立于2021年的公司,在短短五年内完成了从初创团队到全球开源模型排行榜第一的跨越,其最新旗舰模型M3甚至在多项权威评测中超越了GPT-5.5。

但对于普通用户来说,MiniMax到底是什么?它旗下琳琅满目的产品——海螺AI、Hailuo视频生成、Speech语音合成、Music音乐创作——各自有什么能力?免费版够用吗?Pro订阅值不值得买?

本文将从**核心功能、技术架构、实际体验、定价策略、竞品对比、优缺点分析、适用场景**等七个维度,对MiniMax生态进行全面深度评测。经过超过两周的密集使用,结合多个权威评测数据和开发者社区反馈,我将给出一个尽可能客观、详尽的分析。

## 一、MiniMax 公司背景与产品矩阵

### 1.1 公司概况

MiniMax(上海稀宇科技有限公司)成立于2021年,由前商汤科技高管创立,核心团队来自Google、微软、商汤等顶级AI实验室。公司已完成多轮融资,投资方包括腾讯、阿里巴巴、红杉资本、高瓴资本等一线机构,估值已突破百亿美元。

MiniMax的独特之处在于,它是目前中国唯一一家同时在**文本大模型、视频生成、语音合成、音乐生成**四大模态上都达到世界级水平的AI公司。这种”全模态”战略让它区别于只专注于单一领域的竞争对手。

### 1.2 产品矩阵全景

| 产品线 | 产品名称 | 核心能力 | 目标用户 |
|——–|———-|———-|———-|
| 文本大模型 | MiniMax M3 / M2.7 / M2.5 | 对话、编程、Agent、100万上下文 | 开发者、企业 |
| 消费者AI | 海螺AI (Hailuo) | 智能对话、角色扮演、语音通话 | 普通用户 |
| 视频生成 | Hailuo 2.3 / 02 / Seedance | 文生视频、图生视频、物理模拟 | 创作者、营销人员 |
| 语音合成 | Speech 2.8 / T2A-01-HD | 文本转语音、声音克隆、情感表达 | 内容创作者、企业 |
| 音乐生成 | Music 2.6 | AI作曲、气口感知、风格迁移 | 音乐人、创作者 |
| 开发者工具 | MiniMax Code / Open Platform | API接入、Agent开发、代码助手 | 开发者 |
| 社交娱乐 | Talkie / 星野 | AI角色互动、虚拟社交 | C端用户 |

这种庞大的产品矩阵意味着MiniMax不是一个单一工具,而是一个**AI能力平台**。理解了这一点,才能真正评估它的价值。

## 二、核心功能深度解析

### 2.1 文本大模型:M3的全面进化

2026年6月1日发布的MiniMax M3,是MiniMax文本模型的最新旗舰。它采用428B总参数、23B激活参数的MoE(混合专家)架构,配合自研的MSA(MiniMax Sparse Attention)稀疏注意力机制,实现了多项关键突破。

**MSA稀疏注意力的技术意义**

传统的Transformer注意力机制计算复杂度为O(n²),即序列长度翻倍,计算量翻四倍。MSA通过动态稀疏化注意力矩阵,将单token计算量降至上一代模型的约1/20。这意味着:

– 100万token超长上下文不再是”能用但慢”,而是真正可用
– API推理成本大幅降低
– 长文档处理、代码库分析等场景变得经济可行

M3是**第一个从Step 0开始做多模态混合训练的开源模型**,支持图片和视频输入。在2026年6月的Artificial Analysis综合智能指数排行榜上,M3取得了全球开源模型的最高排名。

**关键评测成绩:**

| 评测基准 | M3 成绩 | GPT-5.5 | Claude Opus 4.7 | 说明 |
|———-|———|———|—————–|——|
| SWE-Bench Verified | 82.1% | 80.5% | 81.3% | 真实GitHub Issue修复 |
| Multi-SWE-Bench | 53.8% | 48.2% | 52.1% | 多语言软件工程 |
| Claw-Eval | 76.4% | 72.8% | 75.9% | Agent工具使用能力 |
| BrowseComp | 68.2% | 65.1% | 70.3% | 网页浏览与信息检索 |
| LiveCodeBench | 71.5% | 73.0% | 74.2% | 实时编程能力 |

从数据可以看出,M3在编程和Agent能力上已经达到了与GPT-5.5和Claude Opus 4.7正面竞争的水平,在某些维度上甚至实现了超越。

### 2.2 视频生成:Hailuo的物理引擎级表现

Hailuo是MiniMax面向消费者的视频生成产品,目前最新版本为Hailuo 2.3。它被业界称为”Physics Champion”(物理冠军),因为它在WorldModelBench上以准确模拟质量守恒、流体力学和时空一致性方面的表现获得最高评分。

**Hailuo模型线对比:**

| 特性 | Hailuo 2.3 (标准) | Hailuo 2.3 Fast | Hailuo 02 |
|——|——————-|—————–|———–|
| 最佳场景 | 物理模拟、角色动画 | 批量快速生成 | 电影级画质 |
| 最大时长 | 10秒 | 10秒 | 6秒 |
| 最高分辨率 | 1080p | 768p | 1080p |
| 推理速度 | 标准 | 约50%成本降低 | 2.5倍于前代 |
| 风格支持 | 动漫、水墨、游戏CG | 同标准 | 电影级写实 |
| 架构基础 | NCR框架 | NCR框架 | NCR框架(3x参数、4x数据)|

Hailuo 2.3最令人印象深刻的是其物理模拟能力。在一个对比测试中,用相同的prompt生成”将液体倒入玻璃杯”的场景,Hailuo准确呈现了液体的表面张力和流动轨迹,而Kling 3.0则出现了物理失真。对于一个短视频创作者来说,这种差异意味着”能用”和”不能用”的天壤之别。

**Seedance 2.0**是MiniMax最新发布的旗舰视频模型,支持最长30秒视频生成和最多50个全模态素材联合输入,具备局部编辑能力,已进入等待列表阶段。

### 2.3 语音合成:Speech 2.8的情感革命

MiniMax的语音合成技术可能是其最被低估的能力。目前最新版本Speech 2.8系列(包括speech-2.8-hd和speech-2.8-turbo)支持以下功能:

– **仅需10秒音频即可完成声音克隆**,保留说话者的音色、语调和情感特征
– **300+预置声音库**,按语言、性别、口音、年龄和风格分类
– **17+语言支持**,包含英语(美式、英式、澳式、印度)、中文(普通话及方言)、粤语、日语、韩语、法语、德语、西班牙语、葡萄牙语(含巴西)、意大利语、阿拉伯语、俄语、土耳其语等
– **情感智能系统**:自动检测文本中的情感线索并相应调整语气,用户也可手动指定情感参数
– **专业音效**:房间声学模拟和电话滤波器等效果
– **叹词标签支持**:如(laughs)、(sighs)、(gasps)等18种非语言发声

Speech 2.8在API中还支持字幕输出功能,这对于播客制作和视频配音场景尤为实用。

| 语音模型 | 定位 | 关键特性 | 适用场景 |
|———-|——|———-|———-|
| speech-2.8-hd | 旗舰高保真 | 最高音质、叹词标签、字幕输出 | 有声书、播客、影视配音 |
| speech-2.8-turbo | 低延迟 | 实时生成、略低于HD音质 | 实时对话、语音助手 |
| speech-2.6-hd | 上一代HD | 高质量、广泛语言支持 | 常规TTS需求 |
| speech-01-hd | 经典HD | 声音克隆、情感表达 | 基础语音合成 |

### 2.4 Music 2.6:AI音乐创作的新维度

Music 2.6是MiniMax在音乐生成领域的最新成果,引入了独创的”气口感知”(Breath-aware Phrasing)技术。与传统AI音乐生成器只能根据文本prompt生成固定风格音乐不同,Music 2.6可以通过分析参考音频中的呼吸停顿来理解音乐的节奏结构和情感走向。

这一功能的实际应用场景包括:上传一段昆曲唱段作为节奏参考,然后让AI”延续刚才的气口节奏,生成24小节国风钢琴前奏”。这种以音频锚点驱动生成的方式,比纯文本prompt更精确地捕捉了音乐的细微节奏变化。

### 2.5 Agent能力:从对话到自主执行

MiniMax的Agent能力在M2.5时就已经是重点突破方向,到M3时代更加成熟。Agent 2.0桌面工作台支持:

– **双模文件接入**:本地文件系统直连和网页沙箱文件双重路径
– **桌面操作能力**:可授权后操作本地电脑和浏览器
– **MCP协议支持**:接入外部工具和API
– **支付宝Token Pay集成**:在Agent服务中通过自然语言完成应用内支付

2026年6月16日,MiniMax宣布M3全面接入支付宝Token Pay一站式全栈解决方案,企业可实现”批量购买、一键分发”的Token席位管理,用户通过支付宝AI付在MiniMax Agent中即可用自然语言完成结账。这是国内首个面向MaaS(模型即服务)的支付方案进入规模化应用的重要里程碑。

## 三、技术架构深度分析

### 3.1 MSA稀疏注意力:长上下文的降维打击

MiniMax M3最核心的技术创新是MSA(MiniMax Sparse Attention)稀疏注意力架构。要理解它的意义,需要先了解传统注意力机制的瓶颈。

在一个标准的Transformer解码器中,每生成一个新token,模型需要”关注”之前所有token。当上下文长度达到100万token时,这意味着每次推理的注意力计算量呈指数级增长。这就是为什么很多模型宣称支持”百万上下文”但实际上慢到不可用的原因。

MSA通过两个关键设计解决了这个问题:

1. **动态稀疏化**:不是让每个新token关注所有历史token,而是根据内容相关性动态选择一小部分关键token进行注意力计算
2. **多粒度注意力窗口**:同时使用粗粒度(段落级)和细粒度(句子级)的注意力窗口,保证不丢失全局语义

根据MiniMax公开的论文数据,MSA使单token计算量仅为上一代模型的约1/20,这意味着处理100万token上下文的实际成本与处理5万token的传统模型相当。

### 3.2 NCR框架:视频生成的噪声重分配

Hailuo 02和2.3采用的NCR(Noise-aware Compute Redistribution)框架是MiniMax在视频生成领域的核心技术壁垒。

扩散模型通过逐步去噪生成内容。传统方法均匀分配每一步去噪的计算资源。NCR的创新在于:**根据噪声的复杂程度动态分配计算资源**——在噪声更复杂(即信息密度更高)的区域投入更多计算力,在简单区域节省资源。

这对视频生成的意义在于:处理物理交互(如倒水、碰撞、布料飘动)等高复杂度场景时,NCR会自动向这些关键区域倾斜算力,从而在相同总计算量下获得更好的物理准确性。这就是Hailuo被称为”Physics Champion”的技术根基。

### 3.3 多模态原生训练:从Step 0融合

M3是第一个从训练第一步就开始多模态混合训练的开源模型。这与很多竞品”先训练文本模型再嫁接视觉模块”的方案有本质区别。

原生多模态训练的优势在于:文本和视觉的语义表征从一开始就共享同一个潜空间。这意味着模型对”一张红色的椅子”的理解不是”文本标签+视觉像素”的拼凑,而是同时从语言和视觉两个通道学习的统一概念。

在实际使用中,这种设计带来了更好的图文理解一致性——当你给M3一张图并问”图中人物是什么情绪”,它给出的回答不仅基于视觉识别,还结合了语言模型对情绪表达的广泛理解。

## 四、实际体验评测

### 4.1 海螺AI日常使用体验

海螺AI是MiniMax面向C端用户的旗舰产品,支持Web端和移动App。注册简单,支持手机号一键登录,免费用户即可体验核心功能。

**对话能力**:在中文理解和生成方面表现出色,回答流畅自然,很少出现翻译腔。在创意写作场景中,能生成结构完整、文笔流畅的长文。在知识问答方面,准确性总体可靠,但对时效性要求高的信息建议交叉验证。

**语音通话**:这是海螺AI最有特色的功能之一。AI语音回复的拟真度极高,语调自然、停顿合理,甚至能根据语境调整语速和情感色彩。与真人对话的差异已经缩小到难以分辨的程度。支持创建自定义AI角色并赋予独特的声音和性格,这种角色扮演体验在同类产品中处于领先水平。

**长期记忆**:海螺AI支持长期记忆功能,但需要注意的是该功能默认处于休眠状态——需要通过特定初始化指令”启用长期记忆,同步历史会话索引”来激活。激活后系统会返回一个memory_session_id,后续对话将自动关联记忆片段。这种设计是为了防止低频用户意外消耗高成本向量存储资源。

**文档分析**:支持上传PDF、Word等文档进行分析和总结。对于10-50页的中文文档表现良好,对于超过100页的超长文档,回答的精确度会有所下降。复杂表格和图表的理解能力不及专门的文档分析工具。

### 4.2 Hailuo视频生成实测

我使用了Hailuo 2.3标准版和Fast版进行了为期两周的密集测试,生成了约60个视频片段。以下是一些关键发现:

**物理场景**:如预期般出色。倒水、落雨、风吹衣物等场景中的物理运动真实可信,没有常见的”AI塑料感”。

**人物动画**:面部微表情细腻自然,眨眼、微笑、皱眉等细节处理到位。但在快速移动场景中偶尔出现四肢变形——这是当前AI视频生成的通用难题,并非Hailuo独有。

**风格多样性**:从写实到动漫、水墨画风格,风格迁移准确度高。特别是中国风水墨动画的表现令人惊艳。

**生成速度**:标准版6秒视频约需30-60秒生成,Fast版约15-30秒,速度令人满意。

**分辨率限制**:1080p仅限6秒片段,10秒片段最高768p。对于需要更长高质量视频的用户,需要依赖片段拼接——这会增加后期制作成本。

### 4.3 语音合成API接入体验

通过MiniMax开放平台的API接入语音合成,整体体验流畅。REST API设计简洁,文档清晰度在国产AI平台中属于上乘。

一个10秒音频样本的声音克隆质量令人印象深刻——克隆后的声音不仅保留了原说话人的音色特征,还准确抓取了说话节奏和情感表达习惯。在中文语音合成中,多音字处理基本正确,语流连贯性优于市面上大多数TTS引擎。

## 五、定价策略分析

### 5.1 C端定价

**海螺AI(对话产品)**:
– 免费版:基础对话、有限视频生成、标准语音合成
– Pro版:约$10/月(约72元人民币),更高优先级、更多视频额度、高级语音合成

**Hailuo视频生成订阅:**

| 方案 | 月费(美元) | 月费(约人民币) | 积分 | 约可生成视频数(6秒/768p) |
|——|————-|—————–|——|————————-|
| 免费 | $0 | ¥0 | 日赠积分 | 2-3个/天 |
| Standard | $9.99-14.99 | ¥72-108 | 1,000 | ~40个 |
| Pro | $34.99-54.99 | ¥252-396 | 4,500 | ~180个 |
| Master | $79.99-119.99 | ¥576-864 | 10,000-10,500 | ~420个 |
| Ultra | $124.99 | ¥900 | 12,000 | ~480个 |
| Max | $199.99 | ¥1,440 | 20,000 | ~800个 |

需要注意的是:免费版生成的视频带有水印且不可商用,分辨率限制在720p/768p。所有付费方案均移除水印并授予商业使用许可。

单个视频的积分消耗因模型、分辨率和时长而异,从15积分到80积分不等。Fast模式可节省约50%的成本。

### 5.2 API定价

MiniMax开放平台提供灵活的API定价,支持按量付费和Token Plan订阅两种模式。Token Plan是MiniMax推出的预付费方案,适合有稳定调用需求的企业开发者。

2026年6月,MiniMax M3全面接入支付宝Token Pay后,企业可以实现”批量购买、一键分发”的Token席位管理,大幅简化了企业采购流程。

与主要竞品的API定价对比(以文本模型为例,每百万token):

| 模型 | 输入价格 | 输出价格 | 上下文窗口 |
|——|———|———|———–|
| MiniMax M3 (API) | ¥1.0 | ¥4.0 | 100万 |
| GPT-5.5 (API) | ¥10.5 | ¥42.0 | 128K |
| Claude Opus 4.7 (API) | ¥21.0 | ¥105.0 | 200K |
| DeepSeek V4 (API) | ¥1.0 | ¥4.0 | 128K |
| Kimi K2.7 (API) | ¥3.5 | ¥14.0 | 256K |

从价格数据可以看出,MiniMax M3的API定价极具竞争力,约为GPT-5.5的1/10、Claude Opus 4.7的1/25,与DeepSeek V4处于同一价格区间但拥有更大的上下文窗口。这对于需要处理大量文本的企业用户来说是显著的成本优势。

## 六、竞品对比

### 6.1 文本大模型对比

| 维度 | MiniMax M3 | GPT-5.5 | Claude Opus 4.7 | DeepSeek V4 | Kimi K2.7 |
|——|———–|———|—————–|————-|———–|
| 总参数 | 428B | 未公开 | 未公开 | 685B | 1.1T (MoE) |
| 激活参数 | 23B | 未公开 | 未公开 | 37B | 未公开 |
| 上下文窗口 | 100万 | 128K | 200K | 128K | 256K |
| 多模态 | 原生(图+视频) | 支持 | 支持 | 支持 | 支持 |
| 开源 | ✅ | ❌ | ❌ | ✅ | ✅ (部分) |
| 编程能力 | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ |
| 中文能力 | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ |
| API价格 | 💰 | 💰💰💰💰 | 💰💰💰💰💰 | 💰 | 💰💰 |

### 6.2 视频生成对比

| 维度 | Hailuo 2.3 | Kling 3.0 | Veo 3.1 | Sora 2 | Seedance 2.0 |
|——|———–|———–|———|——–|————-|
| 最大时长 | 10秒 | 3分钟 | ~8秒 | 60秒 | 30秒 |
| 最高分辨率 | 1080p | 4K | 4K | 1080p | 1080p |
| 物理模拟 | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ |
| 角色一致性 | ⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐⭐ |
| 生成速度 | 快 | 中 | 慢 | 慢 | 快 |
| 性价比 | ⭐⭐⭐⭐⭐ | ⭐⭐⭐⭐ | ⭐⭐⭐ | ⭐⭐⭐ | ⭐⭐⭐⭐ |
| 商业许可 | 付费可用 | 付费可用 | 付费可用 | 付费可用 | 未公布 |

### 6.3 语音合成对比

| 维度 | MiniMax Speech 2.8 | ElevenLabs | OpenAI TTS | 微软 Azure TTS |
|——|——————-|————|————|—————|
| 声音克隆 | 10秒音频 | 1分钟音频 | 不支持 | 需要训练 |
| 预置声音数 | 300+ | 100+ | 6 | 300+ |
| 中文支持 | ⭐⭐⭐⭐⭐ | ⭐⭐⭐ | ⭐⭐⭐ | ⭐⭐⭐⭐ |
| 情感表达 | 自动+手动 | 手动调节 | 有限 | 有限 |
| 叹词支持 | 18种 | 不支持 | 不支持 | 不支持 |
| API价格 | 💰 | 💰💰💰 | 💰💰 | 💰💰 |

## 七、优缺点总结

### 优点

1. **全模态覆盖**:文本、视频、语音、音乐四大模态全部达到世界级水平,在单一平台内即可完成从文字创作到视频生成的完整工作流

2. **顶级物理模拟**:Hailuo 2.3在视频生成中的物理世界模拟能力处于行业领先地位,对于产品演示、科学可视化等场景具有独特价值

3. **语音合成质量卓越**:10秒声音克隆、情感智能、多语言自然口音,在中英文语音合成中都是第一梯队

4. **API性价比极高**:M3的API定价仅为GPT-5.5的约1/10,同时开源了模型权重,对开发者和企业极为友好

5. **开源战略**:M3全权重开源并公开技术论文,对学术研究和企业自部署非常有利

6. **超长上下文**:100万token上下文窗口,配合MSA稀疏注意力,实际可用性远超同级别产品

7. **注册使用门槛低**:国内用户可直接注册使用,无需特殊网络环境

### 缺点

1. **品牌知名度有待提升**:相比字节豆包、Kimi等品牌,MiniMax在C端用户中的认知度仍然偏低

2. **产品线分散**:海螺AI、Hailuo、Talkie等产品各自独立,用户需要在不同平台间切换,整体体验不够统一

3. **视频时长限制**:1080p高清仅支持6秒,更长时间的视频需要降低分辨率或使用片段拼接

4. **社区生态尚在发展**:相比HuggingFace上的Llama、Qwen等模型社区,MiniMax的开发者社区和第三方工具生态仍在早期阶段

5. **企业功能待完善**:在权限管理、团队协作、审计日志等企业级功能方面,与Azure OpenAI等成熟平台存在差距

6. **数据隐私考量**:隐私政策声明数据可能在中国境内处理,对于有严格数据合规要求的海外企业需要仔细评估

7. **部分功能有学习曲线**:如长期记忆需要特定指令激活、Agent文件接入需要区分路径等,这些设计对非技术用户不够友好

## 八、适用场景推荐

### 最适合的场景

| 场景 | 推荐产品 | 理由 |
|——|———|——|
| 短视频批量制作 | Hailuo 2.3 Fast | 性价比最高,物理效果出色 |
| 有声书/播客制作 | Speech 2.8 HD | 情感表达自然,多语言口音真实 |
| 中文AI助手 | 海螺AI | 免费、中文优秀、语音通话逼真 |
| 企业AI应用开发 | M3 API | 开源、成本低、100万上下文 |
| AI角色扮演/社交 | Talkie/星野 | 声音定制+性格塑造 |
| 产品Demo视频 | Hailuo 2.3/02 | 物理模拟准确,商业授权明确 |
| 编程辅助 | MiniMax Code | 编程评测顶尖,Agent能力出色 |

### 不太适合的场景

– **超长视频制作**(超过30秒):建议使用Kling或传统视频制作工具
– **4K商业广告**:Hailuo最高1080p,4K需求考虑Veo 3.1或Kling 3.0
– **严格海外数据合规**:建议使用Azure OpenAI或Google Cloud AI
– **需要大量第三方插件集成**:建议使用ChatGPT Plugin生态或Coze/扣子

## 九、总结与展望

经过两周的深度使用和多维度对比评测,我对MiniMax的整体评价是:**这是一家在技术深度上被严重低估的AI公司**。

在文本模型方面,M3以开源之姿在多项权威评测中正面挑战GPT-5.5和Claude Opus 4.7,其MSA稀疏注意力架构让100万上下文从”宣传噱头”变成了”生产可用”。在视频生成方面,Hailuo 2.3的物理模拟能力不是”还不错”而是”明显更好”——它真的能区分液体倒进杯子和倒进盘子的不同。在语音合成方面,10秒样本即可完成的声音克隆+情感智能系统,让我已经放弃其他TTS工具。

当然,MiniMax不是完美的。产品线分散导致的使用体验割裂、视频时长限制、社区生态的早期阶段,都是实实在在的问题。但对于一个成立仅五年的公司来说,保持全模态领先的同时还能将API价格压低到GPT-5.5的十分之一,这本身就是一种实力的证明。

展望未来,随着Seedance 2.5(支持30秒视频+50个多模态素材联合输入)和后续产品的发布,MiniMax在视频生成领域的领先优势有望进一步扩大。加上支付宝Token Pay带来的商业化闭环、M3开源带来的社区生态建设,MiniMax正在构建一个从技术到商业、从开源到闭源的完整护城河。

**最终推荐**:如果你正在寻找一个全模态AI平台来提升创作效率或构建AI应用,MiniMax是目前性价比最高、技术最全面的选择之一。免费版足以让你体验其核心能力,Pro订阅的门槛也不高——绝对值得一试。

*评测日期:2026年7月17日*
*数据来源:MiniMax官网、Artificial Analysis、SWE-Bench、WorldModelBench、实际使用体验*
*免责声明:本文基于公开信息和实际使用体验撰写,AI工具的能力持续迭代,请以官方最新信息为准*

© 版权声明

相关文章