DeepSeek又发论文了,这回讲的是它自己训练智能体用的沙箱。论文题目够长——《DeepSeek弹性计算(DSec):面向大规模智能体训练的高效沙箱基础设施》,9月19日提交,31页,署名超过130人,创始人梁文锋排在最后一位。团队第一次把内部一直跑着的基础设施摊开讲,单个单元日均服务300万个实例。
沙箱就是给智能体划一块安全操场,让它随便执行代码、调用工具、反复试错,跑崩了也炸不到外面。难的是规模——智能体训练要同时开几十万个环境,还得快速启停、互相隔离。DSec冲着这个场景自研,走弹性计算的路子做调度,把沙箱当成算力来管。DeepSeek把它公开,等于把智能体训练的“水电煤”设计图递了出来。
另一边,伦理测评里DeepSeek也赢了一局。科技媒体Wccftech 10月1日报道,一项最新研究对比了多款主流模型,DeepSeek的V4-Flash在性别议题上保持中立,Anthropic的Claude Sonnet 4.6和OpenAI的GPT-5.5则被指存在“区别对待”。同一个问题换个性别设定,回答的倾向就变了。放到招聘、医疗、教育场景里,这种偏差很致命。
两件事放一起看挺有意思。前者是底层工程,决定智能体能做多复杂的事;后者是模型行为,决定它做完会不会翻车。DeepSeek把沙箱写成论文公开,延续的还是它一贯的开源打法,能摊开的都摊开。