从 Taylor 展开到伊藤引理:微元直觉、随机微积分与分析的入口
从 Taylor 展开的直觉出发,梳理一元、多元、向量形式的 Taylor 公式,并借此理解伊藤引理中二阶项为什么保留;进一步讨论 dx 与 Delta x 的关系、导数与积分的严格含义,以及同一套符号如何在普通微积分、随机微积分和更高级分析中被重新定义。
近期随想:大模型、一手感觉与语言腐败
Hello 大家,好久不见。有一段时间没更新了——其实不是没写东西,只是写到了别的地方。现在来写写近期的感受和想法。 笔记方法的转变:从单篇笔记到体系化知识 首先,我并不是没有写笔记,只是改变了写笔记的方法。最近做了两个笔记项目:一个是之前宣传过的 LLM Notes All-in-One,另一部分是量化相关的笔记。这两部分笔记我都改变了组织形式。 ...
LLM 真的在做强化学习吗?还是一种加权 MLE?
这篇文章是我正在整理的开源项目 leemojiang/llm-notes-all-in-one 中 RL for LLM 系列的一篇。项目会持续整理 LLM、强化学习、Agent 和从零实现大模型相关的学习笔记。如果这份笔记对你有帮助,也欢迎到 GitHub 点一个 Star 支持一下。 ...
从 3D 打印到机械加工:理解公差配合与未注公差
最近在做 3D 打印时,我开始接触机械设计里的一个基本问题:如何保证不同零件能够按照预期装配在一起? 例如,同样标称为 10 mm 的轴和孔,有些场景希望轴能够在孔中顺畅转动,有些场景则希望两者牢固地固定在一起。也就是说,零件之间真正重要的并不只是“尺寸是多少”,还包括“真实制造出来以后,两个尺寸之间允许的误差是多少,以及这种相差会形成什么样的装配关系”。机械设计中用来标准化描述这类关系的概念,就是公差与配合。 ...
4 天写完一篇 paper:我如何用 Pairwise Reference Alignment 给大模型 Eval 加上 Error Bar
这是一篇关于 Pairwise Reference Alignment 的口述式研究随笔:从给大模型 eval 加 error bar 的直觉出发,构造 sign agreement 和 margin observable,并记录用 Agent 在 4 天内完成 idea、论文、实验和发布的全过程。
一把梭穿强化学习在大模型中的应用?
Hello 啊,大家好。我之前一直有一个想法只用一页纸,把强化学习相关的这些东西,尤其是在大模型应用中的这部分推导给写清楚。通俗地讲,就是达到概念的闭包:我希望把推导中涉及的所有概念,尤其是它所依赖的概念和定义,都给写清楚。 ...
让 Hugo 博客被 Google 搜到:Search Console、Sitemap 与 GA4 配置记录
这篇笔记记录一下我今天给 Hugo 博客补 Google 搜索和访问统计配置的过程。之前我对 Google Search Console、sitemap、Google Analytics 这些概念并不是很熟,配置过程中发现它们看起来都和“搜索”有关,但实际上解决的是完全不同的问题。 ...
用 Agent 写书:一次 LLM 知识体系的构建实践
Hello 大家好,好久不见,有一阵子没写笔记了。这段时间一直在忙着疯狂vibe coding——说是coding 其实不太准确,因为做了很多项目,并不完全是写代码的事。但确实有种停不下来的感觉:原本可能要花一个月甚至几天的复杂项目,现在一个下午几个小时就能出结果。然后紧接着快速迭代,继续往下做,这种节奏真的让人欲罢不能。 ...
速通 TypeScript:从运行时、异步事件到类型系统
一篇面向实践的 TypeScript 学习笔记,从 JavaScript / TypeScript 生态、运行时与模块加载、Promise 与事件系统,到类型系统和常见语法细节,建立对 TS 的整体核心概念。
从 Vibe Coding 到测试驱动:我如何把 RAG 项目做成一个搜索引擎
围绕 SummaryAgent 的开发实践,复盘 Vibe/Agentic Coding、测试驱动开发与 RAG pipeline 设计,并讨论如何将 RAG 按搜索引擎的方法进行模块划分、接口设计与验证。