AI企业的核心资产不是办公桌椅,而是算法、模型、数据和代码。但很多AI创业公司在融资尽调时才发现:算法没有专利保护,训练数据来源不明,核心代码没有商业秘密措施,开源模型许可证存在商用限制。
一、AI算法专利申请
2024年起AI专利审查新标准
2024年1月,新版《专利审查指南》增加了AI相关专利审查细化标准。2024年12月,国家知识产权局发布《人工智能相关发明专利申请指引(试行)》,为AI专利撰写提供了操作指导。
审查要点:
| 审查维度 | 具体要求 |
|---|---|
| 充分公开 | AI算法存在"黑匣子"特性,说明书需有足够信息达到充分公开 |
| 公共秩序 | 违反法律、社会公德或妨害公共利益的,不授予专利权 |
| 数据合规 | 数据采集、标签管理、规则设置等内容违反法律的,不授权 |
| 必要证据 | 必要时需提供证据证明发明贡献 |
AI专利布局策略
- 分层申请:功能层(算法模型)、基础层(数据架构)、界面层(人机交互)分层设计
- PCT+国家申请:优先考虑市场体量大、诉讼风险高的国家
- FTO分析:立项之初引入自由实施分析(Freedom to Operate)
- 竞争对手监控:建立专利预警机制
二、训练数据版权与合理使用
核心争议
《著作权法》第二十四条以穷尽式列举13种合理使用情形,模型训练使用作品能否落入现有合理使用范畴,在学理和司法实践中均存在争议。
合规要点
| 数据来源 | 合规风险 | 应对措施 |
|---|---|---|
| 爬取公开网页 | 著作权侵权 | 审查robots.txt和版权声明 |
| 用户生成内容 | 未取得训练授权 | 用户协议中明确约定 |
| 购买数据集 | 来源不透明 | 要求供应商提供来源证明 |
| 开源数据集 | 许可证限制 | 逐项审查许可证 |
法规依据: 《生成式人工智能服务管理暂行办法》第七条要求训练数据"使用具有合法来源的数据"“涉及知识产权的,不得侵害他人依法享有的知识产权”。
三、AI生成内容著作权归属
司法判例
北京互联网法院"AI文生图"案(2023年一审,2024年终审): 用户通过多次调整提示词和参数生成图片,体现了"个性化表达与智力投入",符合独创性要求。判决侵权成立,赔偿500元。该案确认AI生成内容使用者可以享有著作权。
上海首例AI大模型著作权侵权案(2025年): 被告使用AI模型生成《斗破苍穹》相关角色形象,赔偿5万元(3万元经济损失+2万元合理开支)。
归属原则
- AI模型本身不是法律主体,不能成为"作者"
- 用户投入独创性劳动(提示词、参数设置、图片选定等)可被认定为创作者
- 平台与用户可通过合同约定著作权归属
四、软件著作权登记
登记流程
| 步骤 | 时间 |
|---|---|
| 账号注册+实名认证 | 1天 |
| 在线填报+上传材料 | 1-2天 |
| 受理审查 | 60个工作日 |
| 登记发证 | 审查通过后发放 |
登记价值: 软著登记是高新技术企业认定的必要条件,也是融资尽调的标配资产。
五、商业秘密保护
AI企业商业秘密清单
AI企业应将以下资产纳入商业秘密保护范围:
- 专有训练方法
- 行业数据集
- 模型参数和权重
- 提示词资源库
- 技术管理规范
- 核心代码库
保护措施
| 措施 | 具体做法 |
|---|---|
| 密点清单 | 对算法、训练数据、代码逐项确权,避免"泛保密" |
| 权限管控 | 代码资源库权限分级,严控核心资产访问 |
| 操作留痕 | 部署数据防泄露、访问控制、异常监测 |
| 应急处置 | 发现侵权立即固定证据 |
| 数字化管控 | 权限分级、数据脱敏、加密存储 |
六、开源模型许可证合规
主流模型许可证对比
| 模型 | 许可证 | 允许商用 | 关键限制 |
|---|---|---|---|
| Llama 3 | Meta Community License | 是 | 月活超7亿需单独申请;禁止训练竞品模型;衍生模型需命名带"Llama" |
| Qwen系列 | Apache 2.0 | 是 | 需保留许可证声明和NOTICE文件;可闭源使用 |
| MIT | MIT License | 是 | 需保留版权声明 |
| DeepSeek | DeepSeek License | 是 | 需遵守具体条款 |
“假开源"陷阱
部分模型虽称"开源”,但附加条款可能限制:
- SaaS分发权
- 品牌绑定
- 衍生模型命名
- 大规模商业使用
建议: 使用开源模型前,逐条审查许可证中的商用限制条款。
七、典型纠纷案例
| 案例 | 法院 | 要点 |
|---|---|---|
| 四位插画师诉Trik AI | 北京互联网法院 | AI训练使用美术作品是否构成合理使用 |
| AI文生图案 | 北京互联网法院 | 用户投入独创性劳动可享有著作权 |
| 生成式AI平台侵权案 | 广州互联网法院 | 全球首例生成式AI平台侵权判决 |
| AI声音克隆案 | 北京互联网法院 | 全国首例AI生成声音人格权侵权 |
| AI画师侵犯著作权案 | 北京通州法院 | 利用AI复制美术作品,获利27万元,构成犯罪 |
常见问题
Q:AI算法能申请专利吗? A:可以。2024年新版《专利审查指南》已细化AI专利审查标准。关键是说明书要充分公开算法的技术细节,不能仅写概念。
Q:我们用开源模型做商业产品,需要开源我们的代码吗? A:取决于许可证。Apache 2.0(如Qwen)不要求开源衍生代码。但GPL类许可证要求开源。Llama 3有月活7亿门槛和竞品限制。使用前务必审查许可证。
Q:员工离职带走了训练数据,算侵犯商业秘密吗? A:如果训练数据满足商业秘密三要件(不为公众知悉、具有商业价值、采取了保密措施),可以主张商业秘密侵权。建议事前建立密点清单和权限管控体系。
本文依据《专利法》《著作权法》《反不正当竞争法》《生成式人工智能服务管理暂行办法》及2024年新版《专利审查指南》编写。如需AI企业知识产权布局服务,请联系 简深律师事务所。