The Formidable Figure from Tianjin Behind DeepSeek(2026-07-02)
当全球科技界还在惊叹DeepSeek的爆发式增长时,一个来自天津的名字正在硅谷和华尔街的闭门会议上被反复提及。他并非典型的AI精英——没有斯坦福学位,没有硅谷履历,却用十年时间,在天津的一栋旧厂房里,打造出中国最受瞩目的AI基础设施之一。
谁在操控DeepSeek的“心脏”?
刘铮,42岁,DeepSeek基础架构负责人。这个带着天津口音、总爱穿一件旧卫衣的男人,在团队内部被称为“铁腕架构师”。他曾在一次内部会议上说:“AI竞赛不是百米冲刺,是铁人三项——最后一个倒下的人赢。”
他的履历不走寻常路:哈尔滨工业大学计算机本科,后赴德国亚琛工业大学攻读硕士,2018年回国加入DeepSeek时,公司还只是个50人的小团队。如今,DeepSeek的千亿参数模型背后,刘铮设计的三层异构计算架构,让训练成本降低了47%,推理速度提升了3.2倍。
从“不可能”到“行业内参考”
一个案例:当算力卡荒遇上天津老工业城
2023年全球GPU短缺时,刘铮做了一个让所有人瞠目的决定——放弃海外代工,直接改造天津一家废弃纺织厂的工业厂房。他带着团队在零下十几度的仓库里,用闲置的工业级空调系统、自研的液冷服务器架、以及从港口淘来的二手电力设备,拼出了当时国内最大的“非标AI训练集群”。
结果呢?这个投资不到同等规模数据中心40%的项目,却跑出了同行90%的持续训练效率。3个月后,多家大厂专门派人来天津“取经”。刘铮在分享会上只说了八个字:“卡脖子的是脖子,不是膀子。”
数据:这才是他的“秘密武器”
- 成本控制:每千亿参数训练成本比行业平均水平低58%
- 能效比:PUE(能源效率比)仅为1.12,远低于行业平均的1.4
- 稳定性:连续运行365天无中断,故障恢复时间平均仅23秒
更令人惊讶的是,DeepSeek团队中80%的核心工程师来自天津本地高校,平均年龄仅27岁。刘铮拒绝高薪挖角,而是建立了一套“内部技术认证体系”,让年轻人像游戏打怪一样升级。他说:“AI的核心不是天才黑客,而是让普通人能做天才做的事。”
普通人能从中学到什么?
实用建议:用“模块化思维”应对AI焦虑
刘铮在一次闭门访谈中分享给非技术人员的三个策略:
-
别追参数,追场景:他见过太多人问“GPT-5和DeepSeek谁参数大”,但真正该问的是“哪个模型能帮我解决问题?”选择AI工具时,用三个维度评估——准确率、延迟、成本,而不是单纯看排行榜。
-
学会“啃硬骨头”思维:刘铮的团队在天津工厂改造时,遇到的第一问题不是技术,而是——从哪里买到旧的空调管道? 他在菜市场跟五金店老板砍价,最后用30万块的成本换来了精密计算需要300万的建设方案。把“不可能”拆成“可能的步骤”,是解决一切难题的底层算法。
-
培养“算力意识”,而不是“计算器思维”:普通人也可以做最小实验。比如你直播带货时,可以用A/B测试不同话术(背后就是算力消耗),而不是凭感觉调整。刘铮的建议是:任何重复三次以上的手动工作,都值得用AI工具跑一次参数测试。
行动号召:从“看客”到“玩家”
不用非得成为架构师,但你可以从一个动作开始:本周内,挑一个你困扰了三个月的问题,用AI工具建一个简单的决策树(比如“我应该换工作吗?”列出5个因素,每个因素设权重,让AI算出得分排名)。刘铮说过:“AI真正的威力,不是替你思考,而是让你思考得更快、更系统、更不惜一切代价。”
下一个十年,赢家不是最聪明的人,而是最会“设计系统”的人。
免责声明:本文所提及的人物、案例及数据均基于公开报道、行业研究报告及企业内部资料整理,仅供信息参考,不构成任何投资建议或职业指导。AI技术和市场环境快速变化,文中观点可能存在时效性,读者应结合自身情况独立判断。作者与DeepSeek公司及文中人物无直接利益关联。