Workflow
DeepSeek R1
icon
搜索文档
梁文锋成长史
投资界· 2026-08-26 16:02
核心观点 - 梁文锋从量化投资转型AI,创立DeepSeek,以开源、低成本、高性能策略颠覆AI行业格局,其成功源于兴趣驱动、技术积累与长期主义价值观[6][7][8] 梁文锋早期经历与教育背景 - 梁文锋1985年出生于广东吴川,是文堂梁氏第十八世孙,祖先梁焘为北宋副宰相,被贬化州后安葬于此[4][5][6] - 父亲梁栋为梅菉小学教师,母亲为边岭小学教师,梁文锋5岁提前入学,在梅菉小学教职工宿舍长大[7][8] - 小学成绩优异,课堂专注、积极回答问题、喜欢挑战难题、善于总结学习方法[8][9] - 学习经验包括兴趣广泛、不拘泥课本、有自学方法[10] - 参加数学奥赛获全国二等奖,在梅菉镇“六一”学科竞赛获全镇第一名,获直升吴川一中资格[11] - 初中成绩中上游,全校排名约百名,中考819分,仅超吴川一中录取线二十多分[11] - 初中开始接触电脑,请老师教学,学会查信息、找资料、学英语、修电脑[12] - 高一成绩追上来,高二进入年级前十,高三稳定前三[13] - 2002年高考标准分806,全省排名约280-320名,英语842分全省第48名[13][14] - 各科均衡,总分吴川市第一,但非湛江市状元[16][17] - 放弃清北,选择浙大电子信息工程专业,因清北难选好专业,浙大可选心仪专业[17] 浙大求学与早期技术探索 - 2002年10月进入浙大信电学院信电系,住紫云3舍,后搬至玉泉校区[18][19] - 浙大精神“诚”“勤”,学风目标感强、自主学习动力足,氛围自由[20][21] - 班主任为63岁陈抗生教授,曾教段永平、陈明永等[22][23] - 梁文锋不喜欢的课不去上,自学数字电路和模拟电路,把木吉他改造成电吉他[23] - 曾骑自行车周游华东数省,不住旅店,野外搭帐篷[24] - 2005年与同学参加第七届“索尼杯”全国大学生电子设计大赛,获全国一等奖[28] - 因获奖获研究生推免资格,但错过当年,2007年入学,2010年毕业[29] - 硕士师从项志宇,研究机器视觉,论文为PTZ摄像机目标跟踪算法[30] - 论文解决思路:自动控制多路开关矩阵、智能跟踪,与DeepSeek多头潜在注意力机制底层逻辑一致[30] 量化投资起步与幻方量化 - 2008年读研第二年,投入8万元本金开始炒股炒期货[32] - 通过数理知识、概率论、计算机代码分析交易数据,寻找市场套利空间[33] - 用数字图像处理截取行情数据,自主编写程序实现自动化交易,是国内量化交易第一批人[33][34] - 2009年到艾麒信息实习,任新技术部经理,月薪1.6万,负责人工智能视频与图像技术研发[34] - 2010年研究生毕业,先到成都尝试AI落地场景,未获进展,后回杭州专注量化投资[36] - 2011年独闯西藏阿里无人区,被困一周,被藏民所救,菲亚特汽车留在无人区[24][25][37] - 2013年与徐进、郑达韡成立杭州雅克比投资管理有限公司[38] - 2015年成立杭州幻方科技有限公司,后更名浙江九章资产管理有限公司,推出“幻方量化”品牌[38] - 幻方名字源于洛书《九宫图》,英文High-Flyer意为“高飞者”[39] - 从2008年8万元本金,7年滚动发展到过亿元,复合年收益率177%[39][40] - 2015年底管理自有资金接近5亿,2016年开始对外募资达10亿,2017年30亿,2018年60亿[51] - 2019年8月成为百亿私募,全国量化四巨头之一[51] - 2020年7月管理资金超200亿,2021年7月成为全国首家千亿量化私募[52] - 后主动回撤至约450亿元,2025年回升至800-900亿[52] - 2019年获“三年期金牛私募管理公司”和“最受信赖金牛私募管理公司”两个金牛奖[52] - 梁文锋在金牛奖分享会演讲《A股量化投资新趋势》,后传播为《一名程序员眼里中国量化投资的未来》[52] - 2021年为西蒙斯传记《征服市场的人》作推荐序《创造理解市场的模型》[53] 量化投资行业趋势与转型AI - 梁文锋2019年金牛奖演讲指出:量化投资短期有几十倍增长空间,长期平均收益向市场收敛,超额收益率最终为零[59][60] - 量化投资符合摩尔定律,每18个月投资能力翻倍,但市场有效性提升导致边际收益递减[60] - 市场完全有效时,量化策略失效,指数成为真正价值投资[60] - 梁文锋判断:未来几年中国市场有效性会进一步提高,但离完全有效还很远[61] - 2019年幻方经历最大回撤,2020年CEO陆政哲致投资者信提到需“挖掘金融市场深处的alpha”[62] - 2016年10月幻方将量化模型从线性模型和传统机器学习升级为深度学习算法模型,处理器从CPU升级为GPU[65] - 2017年幻方持续扩大AI算法和软硬件研发团队,年底几乎所有量化策略采用AI模型计算[66] - 2018年幻方遭遇算力瓶颈,面临“AI为量化服务”还是“量化为AI服务”的决策[67] - 幻方官网“幻方历程”2018年描述:第二句话为“确立以AI为公司的主要发展方向”[68] 幻方AI投入与萤火超算集群 - 2019年12月注册成立幻方AI,目标为“AI的算法与基础应用研究”[72] - 启动“萤火一号”AI超算集群,设计搭载500块显卡,实际落成扩容至1100张[72] - 萤火一号占地面积相当于篮球场,每秒1.84亿亿次浮点运算,大型模型训练从2个月缩短至3天半[72] - 萤火一号总投入接近两个亿,全部来自幻方自有资金[72] - 幻方是唯一一家用千卡规模做大模型训练的金融科技公司[73] - 团队从零开始摸索超算散热等技术,2019年底至2020年初受特殊时期影响,但2020年3月建成启用[74][75][76] - 2021年上线“萤火二号”,投资十个亿,占地约十个篮球场[78] - 萤火二号搭载10000张PCIe版A100 GPU,性能逼近英伟达DGX-A100,成本减半、能耗降低40%[79] - 梁文锋解释投入:一件激动人心的事不能单纯用钱衡量,就像家里买钢琴,因为有一群急于弹奏乐曲的人[80] - 2022年幻方慈善捐款:公司向慈善机构捐赠2.2138亿元,员工“一只平凡的小猪”个人捐助1.38亿元,合计至少3.5938亿元[90][91] - 幻方成立公益工作小组,重视儿童、妇女教育、发展和大病保障项目[94] - 2022年萤火二号取得多800口交换机互联加核心扩展子树软硬件架构革新,算力扩容翻倍[95] - 新h f a i框架让模型加速50-100%,集群平均占用率达96%以上,全年运行任务135万个,共计5674万GPU时[95] DeepSeek创立与产品发布 - 2023年4月幻方公众号发文《幻方新征程》,宣布集中资源投身AI,成立独立研究组织,探索AGI本质[112] - 强调“不做中庸的事,用最长期的眼光去回答最大的问题”[113] - 2023年7月17日注册成立“杭州深度求索人工智能基础技术研究有限公司”,模型名DeepSeek[114] - 2023年11月2日发布首个开源代码大模型DeepSeek Coder,免费商用,完全开源[114] - DeepSeek Coder在国际权威数据集HumanEval编程多语言测试上领先所有开源模型,包括Meta CodeLlama[115] - 2023年11月29日上线DeepSeek LLM 67B,性能接近GPT-4.0,在近20个中英文公开评测榜领先Meta LLaMA2 70B[116] - 性能逼近顶级闭源大模型,完全开源、无需申请、免费商用,全球首个[117] - 2024年5月6日发布DeepSeek V2,凭借多头潜在注意力(MLA)与混合专家架构(MoE),性能比肩GPT-4[119] - V2 API定价只有GPT-4的1%,被称为“便宜得令人发指”[119] - V2引发行业地震,当月国内大模型大幅降价:阿里降价97%,智谱降价80%,字节豆包通用模型定价比行业平均便宜99.3%[120] - DeepSeek被称为“价格屠夫”和“AI界拼多多”[121] - 国际技术圈好评如潮,称“可能是今年最好的一篇论文”“充满惊人智慧”“中国制造的大模型将和无人机、电动车一样不容忽视”[121]