147. 和蚂蚁灵波沈宇军聊:机器人原生基础模型、大脑和本体的关系、预训练与数据scale up、老师汤晓鸥
蚂蚁灵波首席科学家沈宇军与小君深度对谈,分享了灵波从创立到发布第二代具身基础模型的完整历程。 沈宇军坚持"具身原生"路线——从物理世界需求出发,完全重新训练机器人基础模型,而非在数字世界模型上嫁接。 他认为机器人的GPT-1时刻尚未到来,核心瓶颈在于具身数据的scale up,目标是从6万小时迈向百万小时级别。
中文 AI / 大模型 / Agent 长访谈,多为 2-4h 中英双语放送
蚂蚁灵波首席科学家沈宇军与小君深度对谈,分享了灵波从创立到发布第二代具身基础模型的完整历程。 沈宇军坚持"具身原生"路线——从物理世界需求出发,完全重新训练机器人基础模型,而非在数字世界模型上嫁接。 他认为机器人的GPT-1时刻尚未到来,核心瓶颈在于具身数据的scale up,目标是从6万小时迈向百万小时级别。
硅谷机器人公司 Physical Intelligence (Pi) 的研究员柯立一鸣(K)与小峻进行了一场近4小时的深度对谈。K 从个人成长经历讲起——安徽芜湖的竞赛少年、三次换专业、博士七年做筷子机器人——完整勾勒出一个"看起来乖实则叛逆"的研究者画像。访谈深入讲解了 Pi 从 Pi0 到 Pi0.6★ 三代模型的研究历程(能力→泛化→表现),剖析了强化学习在机器人中的本质问题(探索、归因、奖励函数),并绘制了一幅完整的机器人江湖谱系图——从 CMU 传统派到 Berkeley 机器学习派,从特斯拉到 Figure、1X,从中美硬件产业链对比到机器人自我繁殖的科幻想象。K 以"贪心算法 vs 动态规划"比喻人生哲学,反思硅谷的生产力崇拜,展现了一位在科学与人文之间寻找平衡的研究者的独特视角。
前SpaceX火箭首席制造工程师洪力德(Louis Hong)口述SpaceX开发史与马斯克管理内幕。 七年内部视角讲述猎鹰9号从一年发射一次到年产百次的量产扩张、马斯克"可乐罐"式第一原理推问、"接受你辞呈"的冷酷管理、十倍级思维。 深入星链的物理逻辑、SpaceX收购xAI与太空数据中心的底层原因、太空产业链Apple/Android双生态投资框架,以及为什么2026年是太空赛道的转折点。
小群对安克创新创始人阳萌的4小时深度访谈。阳萌系统性地阐述了他用15年创业实践提炼出的一套消费电子公司理论体系:从消费者的"一三五七"分层、品类的"浅海与深海"、公司的三种类型,到CEO治理的"国王vs总统"模式。访谈深入讨论了安克从"五系品质公司"向"七系极致创新公司"的艰难转型,包括自研存算一体芯片的决策逻辑、三层护城河理论、AI中台日均1500亿Token的组织实验,以及"创造者拿七股东拿三"的分配哲学。
何小鹏返场深度访谈。他详细解释了小鹏汽车去年叫停"小几十个亿"旧智驾体系、全面转向AI原生路线的巨大赌注, 提出了"缝合怪"概念来批判软件工程+AI工具的传统路径。机器人方面,他分享了Iron人形机器人的诞生、那场"是不是 真人"的舆论风暴、以及通用人形机器人"两成胜率"的冷静判断。此外还谈及GX旗舰SUV的技术融合、L4自动驾驶18-24个月 的时间预判、"30年五家车企"的产业终局,以及技术剧变下CEO从逻辑论到公理层的焦虑与信念重构。
真格基金管理合伙人代雨森复盘"Year of R"预测被打脸的经历,深度分析了AI行业6个月来的叙事变迁——从模型王座轮流转到Anthropic组织优势,从Return问题的三步链条到Harness作为新操作系统的崛起。他提出了Agent进入人类世界的三步走框架,并反思了移动互联网金科玉律在AI时代为何全面失效。
Freda Duan 返场小君的商业访谈录,深度拆解 Tokenmaxxing 的本质、Anthropic 递归自我改进的飞轮、 AI 时代组织架构的底层逻辑(从"把电机塞进蒸汽机"到"接力赛变篮球赛"),以及 Mag 7 现金流悬崖和 IPO 浪潮的市场冲击。后半段转向感性的维度——在 AI 能回答 95% 信息型问题的时代,人与人之间还剩下什么。
俄亥俄州立大学教授、斯隆研究奖得主苏煜从技术史纵深复盘了 AI Agent 的演化——从 1950 年代的逻辑智能体到今天的 Language Agent。 他深入剖析了 OpenClaw Moment 与 ChatGPT Moment 的类比、Coding 作为数字世界根基的洞见、以及 Agent 从通用到专精的关键瓶颈。 苏煜还分享了他的创业公司 New Cognition 的愿景:让 Agent 通过持续学习构建"工作世界模型",成为各个领域的专家。
小米大模型负责人罗福莉的 3.5 小时深度对谈:从春节凌晨 2 点 OpenClaw 觉醒,到 MiMo V2 系列 (Pro / Omni / TTS) 的"悄无声息伏击",再到 Agent 时代后训练算力 1:1、组织扁平化、AGI 两年内可期。 当下范式已从 Chat 切到 Agent —— 1T 基座 + 后训练敏捷性是新的入场券。
小米大模型团队负责人罗福莉的第一次长时间技术访谈。她系统阐述了 OpenClaw 如何成为一个划时代的 Agent 框架,以及 Agent 范式如何从根本上改变了模型训练的经济学——从预训练主导向后训练与预训练并重转变。访谈涵盖 MIMO V2 家族(Pro/Omni/TTS)的架构哲学、Hybrid Attention + MTP 的技术选择、1T 参数模型的训练挑战、组织平权实验,以及对 AGI 时间线和中美代差的判断。
张小珺对 24 岁 Axiom 创始人洪乐潼的 4 小时长访谈。00 后华人女孩、MIT 摩根奖得主、 斯坦福数学博士辍学、A 轮 16 亿美元。访谈把 AI for Math 的来龙去脉讲透——从 1960s ATP 到 2024 年 DeepMind AlphaProof,再到 2025/12 Axiom 拿下 Putnam 满分 98.93%; 也讲透了洪乐潼的创业心智:蛮力型选手、对苦难上瘾、bet system not model、 把自己定义成 "research scientist intern" 而非 CEO。
24岁的00后华人女孩洪乐潼创办了AI for Math公司Axiom,7个月内从0到16亿美元估值。在这期4小时的深度访谈中,她讲述了从广州奥数少年到MIT蛮力型选手,从斯坦佛法学院到硅谷创业者的独特轨迹。她分享了形式化证明(Lean)如何将数学变成可验证的代码,Axiom如何在普特南数学竞赛拿到满分,以及她为何认为超级智能应该是专用的(ASI)而非通用的(AGI)。
广密与主持人小俊回顾 2026 Q1 全球大模型进展。核心判断:Coding 已从 chatbot 第一幕跨入 agent 第二幕,Opus 4.5→4.6 带来 GPT-3→GPT-4 级别的代际提升。深度分析硅谷御三家 Anthropic/OpenAI/Google 的战略分化、组织文化差异与关键误判,探讨模型成为新一代操作系统的终局路径,以及白领通缩与失业的社会影响。
自然选择创始人 Tristan 张小帆深度阐述 AI 社交产品 Elys(极乐世界)的底层范式:从低维标签到高维 Context 的转变,Context 飞轮的设计逻辑,以及"做自己、构建主体性"这一 AI 时代的核心命题。同时分享了他从音频平台窄播到恋爱游戏再到 AI 创业的三段经历,以及面对 ChatGPT 等巨头的竞争策略。
张小珺《商业访谈录》第 134 期:和光轮智能 CEO 谢晨把 AI 的"数据"这架马车 做成一次产业综述。从数据 = 教育的第一性类比,到朱玉可提出的数据金字塔 (真机 / 仿真 / 人类第一人称视频),再到为什么特斯拉模式在具身不成立、 BEHAVIOR Challenge 的 26%、为什么"先失败再成功的数据最贵",一直到终局: 一家 AI 教育公司,提供环境让模型自己修炼内功。
光轮智能创始人兼CEO谢晨(Steve)以跨越物理、量化金融、自动驾驶、具身智能的独特视角,完成了一期关于AI数据产业的深度综述。从数据≈教育的第一性框架,到数据金字塔的构成与定价,到"先失败再成功"的数据质量新标准,再到五家大模型团队角逐机器人大脑的版图——这期节目试图用一集讲清楚驱动AI的三驾马车之一:数据。
谢赛宁的第一次播客访谈,7 小时马拉松对谈, 覆盖 SJTU ACM Class、UCSD 屠卓文、FAIR 何恺明、NYU 李飞飞, 到 2024 年和 Yann LeCun 共同创立 AMI Labs 的全过程。 贯穿主线:representation learning 是 12 年都没解决的核心问题, LLM 是 virtual intelligence,world model 才是真问题。
NYU 助理教授谢赛宁(Saining Xie)在 7 小时的深度对谈中,完整回顾了从交大 ACM 班到 NYU、从表征学习研究到与杨立昆联合创立 Emi Labs 的历程。他系统阐述了何为世界模型、为什么 LLM 不是通往通用智能的地基,分享了两次拒绝 Ilya Sutskever 的底层逻辑,以及 DiT 如何从一篇被拒稿的论文变成 Sora 的骨架。
张小珺对星海图创始人高继扬的 3 小时访谈。92 年生人、清华电子系物理竞赛保送、 USC PhD 三年半毕业、Waymo 两年、Momenta 两年作为"鲶鱼"轮换感知/定位/规控/NOA、 23 年 5 月放弃 1000 万美金期权创业。访谈把具身智能创业的"反浪漫"逻辑讲透—— 从曾国藩式的"儒家清流到事功"自我重塑,到智能定义本体的轮式双臂选型, 再到 200~250 元/小时的真实数据成本账、VLM+VLA 双系统、 以及"传播周期决定壁垒"的大厂 vs 创业公司分析。访谈录制时正逢联合创始人许华哲离职。
3小时深度访谈,星海图创始人高继扬复盘了从清华物理竞赛到Waymo、Momenta再到创业的全路径。访谈核心覆盖:Waymo与Tesla两条自动驾驶路线的本质分歧(robotics-driven vs AI-native)、Momenta量产文化如何塑造"以客户为中心"的价值观、放弃千万美元期权创业的决策逻辑、具身智能为何必须全栈(整机+智能+数据闭环)、真实数据一小时仅200元的成本账、从开发者市场到生产力市场的"跨越鸿沟"战略、以及许华哲离开背后的价值观取舍。高继扬用"拆解+测量"的工程师思维贯穿全程,展现了一个在"链条极长、毫无浪漫"的机器人行业中步步为营的创始人画像。
印奇在AI行业深耕15年后,从旷视科技联合创始人到同时出任千里科技与阶跃星辰董事长。这场深度对谈中,他复盘了AI 1.0时代的战略失误——"把把都上"的安防之战、上市作为目标的迷失,并提出做基模的商业模式排除法(to B和纯C端软件都不成立),明确"软硬结合+终端"的路线。他坦诚讨论了聪明人的ego陷阱、AI时代组织形态的挑战,以及用"想做×能做×可做"三要素交集做战略取舍的方法论。
妙鸭相机创始人张月光创业两年后首次公开对话。他从京都鸭川边的彻夜思考讲起,回顾了从大厂到创业的觉醒历程,深度剖析了妙鸭为何不是AI Native产品、互联网设计与AI Native设计的范式差异。访谈覆盖了他对AI陪伴赛道、乙女游戏(星棉)、Agent产品(Doky)、新媒介新交互平台理论的系统思考,以及"90分等于0分"的单向门产品哲学。
张小俊在智谱IPO上市当天与CEO张鹏进行了一场三小时深度长谈。从清华实验室到港交所,从"第一个吃螃蟹"的科技成果转化到全球大模型第一股,张鹏完整回顾了智谱六年半的创业历程:技术路线的选择(GLM架构)、ChatGPT前后的融资冰火两重天、百模大战的焦虑、Scaling Law的不迷信、To B与To C的路径抉择、DeepSeek冲击后的反思,以及始终不变的AGI信仰。