开放模型新动向:许可证正在分化

Interconnects AI10 天前

开放模型生态的竞争力正在提升,模型本身之外,许可证也成为影响采用的重要因素。

过去一段时间,许多模型采用自定义许可证,例如 Qwen2.5 72B-Instruct、Llama 系列,以及 DeepSeek V3。后来 DeepSeek R1 改为 MIT 许可证,并在 2025 年带动不少中国模型厂商采用 MIT 或 Apache 2.0。

进入 2026 年,开放模型更具竞争力,也带来了两个值得注意的变化:

  • 一些西方模型厂商开始采用更开放的许可证,例如 Google 和 Meta 的部分模型转向 Apache 2.0。
  • 部分中国前沿模型厂商则开始加入更严格的商业使用条件。

许可证趋势:从开放到附加条件

几个近期案例显示,开放模型的许可证正在分化。

Kimi K3 的许可证要求:如果用户提供推理或微调服务,可能需要签署商业协议。MiniMax M3 则在收入超过一定门槛后要求签署协议,并列出禁止使用场景。

最新的例子是智谱 GLM-5.3。此前 GLM-5.2 及更早版本使用 MIT 许可证,而 GLM-5.3 改为自定义许可证。其针对推理与微调服务提供者设置了如下条件:如果被许可方或其关联方经营“模型即服务”业务,并且其连续 12 个月总收入超过 100 亿美元或等值货币,在将该软件或其衍生作品用于任何商业目的之前,必须通过 Z.AI 的安全审查。安全审查的范围和方式由 Z.AI 合理确定。

这个 100 亿美元门槛相比同类许可证非常高,但条款中的“affiliates / 关联方”可能带来不确定性。英文文本没有明确定义 affiliates;中文文本使用“关联方”,该词在中国法律语境中有既有定义。这种差异可能增加企业采用时的合规评估成本。

需要强调的是,自定义许可证的出现有其商业与安全方面的考虑。但在开放与闭源替代方案都很多的环境中,额外条款也可能成为采用门槛。

本期值得关注的开放模型

Motif-3

Motif-3 由 Motif-Technologies 发布,采用 MIT 许可证。该团队资源相对有限,但在模型训练方面持续展示出一定创新。与此前的 Motif 2.6B、Motif-2-12.7B 相比,Motif-3 的改进较明显,并且在同规模模型中表现可观。

dots3-note-prev

dots3-note-prev 来自 dots-studio。小红书相关团队早在 2025 年就已发布过模型,并非新进入者。文中提到,dots3 使用内部评测框架在 IMO 2026 中取得满分表现。该方向后续仍值得观察。

Qwen3.8-Flash-Next

Qwen3.8-Flash-Next 是 Qwen 下一代架构的预览版本。其架构为 125B-A6B,并包含 51B n-gram embeddings,使用 GDN 与 Qwen Sparse Attention。

这一设计与 Qwen3-Next-80B-A3B-Instruct 有相似之处。作者认为,在 Qwen4 发布前,类似架构可能会更常见,相关生态集成也会逐步完善。

GLM-5.3-Flash

GLM-5.3-Flash 的发布方式也很有特点。它曾以“Ox-Alpha”的名称作为免费可用的“隐身模型”出现在 OpenRouter 和 OpenCode 上,引发用户试用和猜测。

由于模型表现较强,社区一度猜测它可能来自 Cursor、xAI、Gemini,或某个开源实验室的新预训练模型,甚至有人认为其规模超过 1T。这种发布方式在正式揭晓前积累了大量讨论热度,同时也在一定程度上减弱了每次开放模型发布后常见的“刷榜”质疑。

小结

开放模型生态仍在扩张,但“开放”的具体含义正在变得更复杂。模型权重可用并不等于使用门槛完全消失;许可证是否允许商业推理、微调服务,是否设置收入门槛、审查机制或禁止用途,都会影响企业和开发者的采用决策。

对于社区来说,后续评估开放模型时,除了性能、成本和生态兼容性,也需要把许可证条款纳入核心考量。

评论

请登录后发表观点

暂无数据