计算机行业:DeepSeekV3%26R1加速LLM训练%26推理端降本/数据平权,有望开启端侧/AI应用的黄金时代%26传统非AI公司价值重估-250205-方正证券
2025-02AI大模型23免费
报告维度
- 📄 文件全名
- 《计算机行业:DeepSeekV3%26R1加速LLM训练%26推理端降本/数据平权,有望开启端侧/AI应用的黄金时代%26传统非AI公司价值重估-250205-方正证券-23页.pdf》
- 🎯 适合读者
- 战略规划行业研究员
- 📊 核心数据
- ✓ AI应用&端侧确定性受益:训练/推理成本指数级下降,且大模型蒸馏出的小模型效果提升显著;
- AI应用的迭代成本下降&端侧模型可用性明显
- DeepSeek V3/R1:颠覆行业生态的里程碑式创新,训练/推理成本骤降+不依赖监督数据+蒸馏成为捷径+宽松的开源协议
- ➢ DeepSeek R1除了与V3同质的系列创新外,对行业影响最大的点在于论证了SFT过程可能不是刚需/蒸馏头部大模型比训练自有模型更高效:
- 模型效果要好于将原模型基于R1训练框架进行重训练;
- 🏷️ 核心议题
- #大模型#LLM#GPT