我对大模型训练的两个态度

我支持开源

开源普惠,不光是把参数开源,最好训练过程、训练数据、等等细节也都公布其实更好

这样大模型使用的主要成本就变成算力设备折旧、维护、和能源消耗

我支持蒸馏

训练数据的输入是蒸馏人类的公共知识,大模型也应该是人类公共知识的一部分

不应该有区别

垄断只是为了垄断利润,缺点大于优点

我支持大模型从用户端获取数据仅用于训练

只要严格限制用途仅仅是模型训练,就不应该禁止

代码隐私这个东西,本质也是一种"垄断",甚至可能导致某些知识的彻底失传,还不如让大模型把它们内化到参数中。

相关推荐
柒和远方2 小时前
DocResearch 项目面试:把每个模块讲明白,而不是背术语
python·llm·agent
柒和远方2 小时前
DocResearch 项目理解:从一条命令到一份有出处的报告
python·llm·agent
the局外人3 小时前
读懂LangGraph 的分支执行逻辑
后端·langchain·llm
爱上纯净的蓝天13 小时前
只输出选项和概率的模型:判别层的接口契约与阈值工程
人工智能·大模型·llm·模型评估·架构设计
流浪00115 小时前
大模型技术全景(十二):人工介入 HITL、HOTL 与 HOOTL
llm·hitl·人工介入·hotl·hootl
Lintongzg18 小时前
千卡训练的隐形账单:通信不是瓶颈
笔记·学习·性能优化·llm
武子康18 小时前
Cosmos Curator 清洗视频时,哪些片段应该留下?
人工智能·llm·agent
我想问问天19 小时前
Jev 是做什么的?聊聊它能帮 LLM 分担哪些工作
人工智能·llm·aigc
谢白羽20 小时前
对比DP8+EP与TP8在DS MoE部署性能
llm·vllm·大模型部署·sglang