가입 후 초대 링크를 공유하면 동영상 재생 및 초대 보상을 받을 수 있습니다.

Phoenix Yin
@Phoenixyin13
🇺🇸 04美本 | 计算机科学&认知科学 ⚙️AI, cognition, crypto, and the future of intelligence. ✨相信好奇心驱动。相信人永远可塑。
가입 May 2025
980 팔로잉 중    20K 팬
学习的本质是演化还是优化? 主流深度学习习惯于把训练看作静态的梯度下降优化,但从系统论视角来看,这其实是一个非平衡态的动力系统。 无论是扩散模型、流匹配,还是人类大脑处理时序刺激的神经动力学,离散的层级结构在极限下都在向连续的微分方程收敛。 所以我认为,学习不应该是孤立的静态映射,它更应成为带有反馈和鲁棒性的控制过程。 为什么我认为数学很重要? 很多时候,我们缺乏一套能够定量描述主观表征与客观世界映射的数学语言。 有了数学,你便可以构建一种高维抽象与底层降维之间的无缝切换能力。 当别人在看一篇前沿 Paper 时,看到的是复杂的符号和推演; 而当你带着这套体系看过去时,看到的往往是底层的测度空间、算子性质以及对应的硬件实现代价。 但是大部分时间,数学在我们的世界是流于形式的应试工具。 就工程落地与系统实现而言,语言语法层面的浅层学习毫无意义。瓶颈,在于感知。 当我们走完这套理论推演与系统落地的闭环后,你现阶段自然而然就会切入一个 个具体的交叉研究方向。 没有数学功底的交叉研究,在我看来近乎民科思维。想象力极佳,严谨度严重不足。 当前的AI领域,某些概念的堆砌,某些论文的内容,很像是用物理学的词汇、神经科学的名词、再套上一层机器学习的皮,写出一些看似宏大实则无法证伪的东西。 缺乏约束的想象力是灾难。 唯有数学,可以帮你把一个直觉写成连续时间下的随机微分方程或算子方程时,它的边界、假设、奇异点和失效条件才会赤裸裸地暴露出来。 数学,从不只是为了推导好看,它是用来证伪自我幻想的最高标准。 我的判断是,很多研究上的痛点,其实无非就是形式化数学的异化、无根基想象力的泛滥,以及从抽象到物理硬件断层的尴尬。只要数学能力足够强,你就有能力识别大部分空洞的修辞。 我鼓励你,一定要去努力提高数学能力。 关于我说的12-18个月完成这套体系,有些人觉得快得不可思议或根本不可能完成,其实仍然用的是高度同质化的时间计量方式。 我永远相信,如果一个学习者具备极强的自律性、每天能够进行 4 到 6 小时高强度的沉浸式纯深度推演时,这种效率会发生质变。 12 到 18 个月换算下来,是大约 1500 到 2200 小时的纯核心有效输入。 在绝对的专注密度面前,传统大学两到三年的课时量在信息压缩后,完全可以在几个月内被彻底啃透。 看视频、听讲座、做水题的被动输入模式,会让大脑一直在舒适区边缘打转。 我说的那个体系训练,就是倒逼学习者在痛苦与通透的循环中建立逻辑自洽。 一旦突破了前期的思维阵痛期,建立起了以证明为核心的数学直觉,后续的学习速度会呈指数级上升。 因为,越到后面很多的高级理论,本质上都是前面基础概念的自然延拓。
더 보기
接上条,谈谈应用数学、统计学或计算机科学的核心本科到研究生过渡阶段的培养体系(特别是数学层面)。 对于一个具备极强自律性、习惯于沉浸式独处并能啃下早期科学原典的学习者来说,如果每天能投入 4 到 6 小时 进行高强度的推演和刷题,走完这条路线大约需要 12 到 18 个月。如果按传统大学授课节奏,这通常需要两到三年的跨度。 阶段一:纯数直觉与分析基础,这个阶段大概5-7 个月。 我认为这个阶段是建立数学证明思维的关键期,习惯了直接调用算法库的人往往会在这里感到痛苦,但跨过去就能看懂大部分理论前沿的 Paper。 1. 线性代数,1-1.5 个月 目标: 彻底理解线性空间、算子、Spectral Theorem及奇异值分解(SVD)的几何意义。 我的建议是直接看 Sheldon Axler 的 Linear Algebra Done Right。推导谱定理是重塑线性思维的第一步。 2.数学分析 / 实分析,3-4 个月 目标: 建立极限、连续性、紧致性的严格 语言。 这个时期可以看Walter Rudin 的 Principles of Mathematical Analysis(Baby Rudin)。 这本书其实极其精炼,没有任何废话。阅读和死磕课后题的时间比约为 1:3。 习惯阅读原典的思维在这里会有极大优势。 3. 常微分方程 + 本科概率论,1-1.5 个月 目标: 掌握动力系统建模基础和基于微积分的概率直觉。 经过我和一些同学的交流,其实这部分相对简单,更多是计算和物理直觉的培养。ODE 可以快速过一遍,重点放在理解的结构和稳定性上。 阶段二:概率统计的现代基石(约 5-7 个月) 这是真正的分水岭。 测度论将彻底改变你看待随机性和信息的方式,也是深入深度学习理论(比如泛化界、生成模型底层逻辑)的必经之路。 4. 测度论概率,3-4 个月 目标: 重新定义概率,掌握大数定律、中心极限定理的严格证明,以及条件期望的 Radón-Nikodým 导数视角。 这时候Rick Durrett 的 Probability: Theory and Examples就非常重要了。门槛极高,前置条件是必须啃完实分析中的勒贝格积分。这是整个路线中最耗费心智的一环,需要极度的专注和抗挫折能力。 5. 统计推断,2-3 个月 目标: 掌握点估计、假设检验、置信区间背后的数理逻辑,如充分统计量、Rao-Blackwell 定理, 我的推荐是Casella & Berger 的 Statistical Inference。有了前面的基础,这部分的推导会顺理成章,重点在于完成大量的经典习题。 阶段三:工程落地与系统实现(时间因人而异) 理论最终需要转化为系统和代码。 6. 编程与数据处理,增量时间:0-3 个月 这个阶段,对于已经有过多模态计算机视觉研究经验、能够独立提交一作顶会论文并在日常处理庞大算法工程的人来说,Python 的熟练度,真实数据处理经验其实已经处于满级或高度成熟状态。 增量挑战的话,我目前能想到的就是C++ 的性能调优。如果需要编写高性能的底层算子,就比如 CUDA C++这种,或者构建极低延迟的推理引擎,额外拿出 1-2 个月 专注于内存管理、并发控制和硬件级优化即可。 总体来说,这套体系能让你拥有独立开辟新研究方向的资本,无论面对怎样的技术迭代,底层的数理直觉都不会过时。
더 보기