开放模型许可证参考 | How Much To Run AI

查看当前计算器模型目录中开放权重模型的许可证、访问条件和主要限制。

最近更新: 2026-09-21

本页记录当前计算器模型目录中各模型条目的许可证信息。能下载模型,本身不能说明它是开源的,也不能说明它可以不受限制地商用。准备部署的具体 repository 和 checkpoint,应以当时的许可证文件、模型卡、访问条款和适用法律为准。

许可证摘要仅供规划和比较参考,不构成法律意见。具体仓库的许可证、模型卡、访问条款和适用法律优先。

如何阅读

  • 开放权重(Open weights):发布方按指定访问条件提供模型权重。不代表训练数据、代码或模型的所有组件都开源。
  • 开源(Open source):这是另一项判断,取决于许可证和采用的定义。本页不对任何模型作 OSI 认证结论。
  • 可商用:不能只看一个 yes/no 标签。许可证可能包含署名、版权声明、商标、用途、再分发、规模、月活用户(MAU)、模型即服务(MaaS)或另行签约条件。
  • 计算器的模型记录现在会展示 repository、变体、上下文窗口、权重格式、许可证名称、许可证链接、gated 访问标识,以及元数据最后人工核对日期。这些字段仍由人工维护,不会随仓库自动同步。

当前模型目录

计算器条目变体Repository / checkpoint许可证Gated主要限制与注意事项
Qwen 3.8 27BPost-trained 视觉语言Qwen/Qwen3.8-27BApache License 2.0这个稠密多模态 checkpoint 含视觉编码器并支持可调思考模式。Qwen 发布 BF16 Safetensors,Ollama 的 Q4_K_M artifact 标签为 qwen3.8:27b。再分发时需保留 Apache-2.0 要求的声明,并核对精确量化 artifact 的条款。
Qwen 3.8 Flash-NextPost-trained 视觉语言 MoEQwen/Qwen3.8-Flash-NextQwen Community License 1.0(自定义)Qwen4 架构预览:125B 主参数 + 51B N-gram 嵌入 + 4B MTP,每 token 激活约 6B,官方发布 BF16 与 FP8 Safetensors。保留声明的前提下通常可使用和再分发;月活超 1 亿或月营收超 2,000 万美元的产品须显著展示模型名称;经营 MaaS 或 AI 办公助手业务须先取得 Qwen 单独授权(内部使用除外)。
Gemma 4 E2B指令微调多模态google/gemma-4-E2B-itApache License 2.0Google 标注为 2.3B effective、含 embedding 共 5.1B 参数,支持文本、图像和音频输入及 128K 上下文。模型卡 metadata 指向 Google 的 Gemma 4 Apache-2.0 许可证;Ollama 的 Q4_K_M 标签是 gemma4:e2b-it-q4_K_M
Gemma 4 E4B指令微调多模态google/gemma-4-E4B-itApache License 2.0Google 标注为 4.5B effective、含 embedding 共 8B 参数,支持文本、图像和音频输入及 128K 上下文;Ollama 的精确 Q4_K_M 标签是 gemma4:e4b-it-q4_K_M
Gemma 4 12B Unified指令微调 unifiedgoogle/gemma-4-12B-itApache License 2.0这个 encoder-free unified checkpoint 将文本、图像和音频输入直接投影到 decoder-only 模型,支持 256K 上下文;Ollama 的精确 Q4_K_M 标签是 gemma4:12b-it-q4_K_M
Gemma 4 26B A4B指令微调 MoEgoogle/gemma-4-26B-A4B-itApache License 2.0这个文本与图像 MoE checkpoint 完整权重约 25.8B 参数,语言模型每次推理约激活 3.8B。容量估算使用完整权重,不按 A4B 缩小;Ollama 的 Q4_K_M 标签是 gemma4:26b-a4b-it-q4_K_M
Gemma 4 31B指令微调稠密google/gemma-4-31B-itApache License 2.0这个文本与图像稠密 checkpoint 的完整权重约 31.3B 参数,支持 256K 上下文;Ollama 的精确 Q4_K_M 标签是 gemma4:31b-it-q4_K_M
Llama 3.1 8BInstructmeta-llama/Llama-3.1-8B-InstructLlama 3.1 Community License仓库是 gated,需要接受 Meta 条款。商用受 Community License 和 Acceptable Use Policy 约束;对月活超过 7 亿的产品有另行授权门槛,衍生模型还涉及命名和署名要求。
Llama 3.1 70BInstructmeta-llama/Llama-3.1-70B-InstructLlama 3.1 Community License同样适用 Community License、gated 访问、可接受使用政策、规模门槛和衍生模型命名/署名条件。大规模上线前应核对 Meta 的最新条款。
DeepSeek-V3Basedeepseek-ai/DeepSeek-V3MITMIT 通常允许商用、修改和再分发,但需保留版权和许可证声明。仍应核对模型卡和捆绑组件的条款;当前目录记录为总参数 671B、active 37B 的 MoE。
DeepSeek-V4-Flash-0731GA (0731)deepseek-ai/DeepSeek-V4-Flash-0731MIT官方模型卡确认这是取代 Preview 的正式发布版本,保持相同模型规模和结构并附带 DSpark 推测解码模块。当前目录记录为总参数 284B、active 13B 的 MoE,原生 FP4+FP8 权重不等同于通用 INT4;托管 API 公告将该版本称为 public beta。
DeepSeek-V4.1-FlashGA (2026-09-10)deepseek-ai/DeepSeek-V4.1-FlashMIT这个原生多模态 MoE 发布版本按容量估算记录约 749B 总参数:552B backbone 加约 196B Engram;预填充激活 8B、解码激活 16B,支持从 65,536 经 YaRN 扩展的 1M 上下文,原生 checkpoint 为 MXFP4/MXFP8 混合 Safetensors。官方托管 API 调用名是 deepseek-flash
DeepSeek-V4-Pro-0813GA (0813)deepseek-ai/DeepSeek-V4-Pro-0813MIT官方 GA 公告和模型卡确认该 checkpoint 已取代 Preview。官方 checkpoint 使用 Safetensors,expert 权重为 FP4、其他部分为 FP8 mixed;模型卡没有重新声明完整 checkpoint 的 active 参数。计算器使用约 1.7T 总参数做容量估算,不代表性能或生产可用性保证。
GLM-5.2Instructzai-org/GLM-5.2MIT(以模型卡为准)MIT 通常允许商用、修改和再分发,但需保留必要声明。请核对具体模型卡和官方发布资料,因为不同来源的参数量和 checkpoint 元数据可能不一致。
GLM-5.3Post-trainedzai-org/GLM-5.3GLM-5.3 License(自定义)该开放权重 checkpoint 采用自定义许可证,通常允许使用、修改、部署和再分发,但如果模型即服务业务在任意连续 12 个月内的被许可方及其关联方合计收入超过 100 亿美元,商用前必须通过 Z.AI 安全审查。
GLM-5.3-FlashPost-trained 多模态zai-org/GLM-5.3-FlashMIT这是原生多模态 MoE checkpoint,总参数 320B、激活 18B,使用 FP8/BF16 Safetensors 和 1M 上下文。再分发时需保留 MIT 声明,并核对任何单独许可的量化 artifact。
Kimi K3Instructmoonshotai/Kimi-K3Kimi K3 License(自定义)不是无条件的 MIT 或 Apache 许可证。已发布条款要求 MaaS 年收入超过 2,000 万美元的业务另行签约;月活达到 1 亿或月收入达到 2,000 万美元的商业产品,需要显著展示 “Kimi K3”。提供模型服务或再分发前必须阅读最新许可证。

适合非开发人员理解的说明

上面的表格保留了许可证名称和来源摘要。下面用更日常的说法解释它们对使用者意味着什么。这些说明是阅读提示,不是新增的许可证条款。

  • Qwen 3.8 27B:精确 checkpoint 是 Qwen/Qwen3.8-27B,默认 Ollama 标签为 qwen3.8:27b。该 checkpoint 使用 Apache-2.0;再分发多模态或量化 artifact 时仍需核对其随附声明与条款。
  • Qwen 3.8 Flash-Next:精确 checkpoint 是 Qwen/Qwen3.8-Flash-Next(另有官方 FP8 仓库 Qwen/Qwen3.8-Flash-Next-FP8 后缀),Ollama 暂无对应标签。它使用自定义 Qwen Community License 1.0,不是 Apache-2.0:大型产品需显著展示模型名称,MaaS 或 AI 办公助手业务须先取得 Qwen 单独授权。
  • Gemma 4:计算器采用精确的 E2B、E4B、12B Unified、26B A4B 和 31B instruction-tuned checkpoint。Google 以 Apache-2.0 发布 Gemma 4,仓库均非 gated;再分发时需保留要求的声明,并核对精确 checkpoint 与量化 artifact。
  • Llama 3.1 8B 和 70B:需要通过 Meta 的 gated 访问流程并接受相关条款。商用还要遵守 Community License 和 Acceptable Use Policy;大型产品和衍生模型可能有额外要求。
  • DeepSeek-V3:表格引用 MIT 条款,摘要中的基本要求是保留版权和许可证声明。分发前仍要核对模型卡和捆绑组件。
  • DeepSeek-V4-Flash-0731:官方模型卡确认这是取代 Preview 的 MIT 正式发布版本,保持相同模型规模和结构并增加 DSpark 推测解码。表中列出的 FP4+FP8 格式和超大模型规模,需要单独做部署核验;DeepSeek 托管 API 另行标注为 public beta。
  • DeepSeek-V4.1-Flash:精确 checkpoint 采用 MIT 且原生支持多模态。目录按模型卡的 552B backbone 加约 196B Engram 记录约 749B 总参数,预填充激活 8B、解码激活 16B。官方托管 API 调用名是 deepseek-flash;再分发时需保留 MIT 声明,并核对精确 checkpoint 和捆绑组件条款。
  • DeepSeek-V4-Pro-0813:官方模型卡声明仓库和权重采用 MIT,并确认该版本取代 Preview。再分发时应保留许可证声明。其 FP4 expert + FP8 mixed 表示不等同于通用 INT4;计算器中的约 1.7T 总参数只是容量估算输入,不代表性能保证。DeepSeek 托管服务另受单独条款约束。
  • GLM-5.2:表格引用模型卡中的 MIT 条款。使用前请核对当前模型卡和具体发布信息。
  • GLM-5.3:这是 Z.AI 的自定义许可证,不是 MIT;超大型模型即服务业务有安全审查条件,商用托管前应阅读精确许可证。
  • GLM-5.3-Flash:该 checkpoint 采用 MIT 且原生支持多模态。再分发时需保留声明,并核对精确 checkpoint 和量化 artifact。
  • Kimi K3:这是自定义许可证,部分 MaaS 业务和超大规模商业产品需要满足额外条件。提供模型服务或再分发前,应先阅读当前条款。

商用部署前检查清单

针对准备使用的具体 checkpoint,请确认:

  1. Repository、revision,以及它是 Base、Instruct、Chat、Preview 还是其他发布状态。
  2. 许可证文件、模型卡、Acceptable Use Policy 和 gated 访问条款。
  3. 署名、版权、声明、商标、命名和再分发要求。
  4. 是否存在 MAU、收入、MaaS、地域、用户或用途门槛。
  5. 量化文件、adapter、tokenizer、推理代码和其他捆绑组件是否有单独条款。
  6. 计划部署属于直接推理、内部工具、API 还是模型即服务产品。

成本计算器只能帮助估算基础设施支出,不会授予下载、修改、托管或商用模型的权限。

来源

表格中的 repository 链接是核对许可证的首要入口。许可证可能独立于计算器价格数据发生变化,部署当天应重新查看仓库中的 LICENSE、model card 和发布方条款。计算器中的元数据由人工维护并标注核对日期,仅作参考,不是实时合规校验。

图像模型:Qwen-Image-2.1

核验日期:2026 年 9 月 21 日。Qwen Research License Agreement 仅允许非商业研究或评估。商业使用需另行向发布方取得许可,权重可下载不等于可无限制商用。图像成本计算器 不包含商业许可费用。