LEARNING NOTES / ENGINEERING LOG
把学习、实验 和灵感沉淀成 可回看的轨迹。
记录编程、系统、AI 与日常折腾;让思考留下温度、结构和下一次继续出发的位置。
最新文章
15 / 172-
三省六部制 Multi-Agent:可换装的制度化智能体组织
核心 Idea 把古代政治制度的组织结构直接当作 multiagent 系统的编排架构。Agent 必须严格遵循职位职责,不能越权;用户扮演"皇帝",只负责下达任务(上谕)、审批(朱批/驳回)、阅取汇报(奏章)
-
mattpocock/skills:20 万星的 Agent 技能仓库到底做了什么
一句话总结 Matt Pocock(Total TypeScript 作者)把自己的 目录开源成了 mattpocock/skills,目前近 20 万 star。它是一套"小而可组合、可随意修改"的 Agent 技能集合,覆盖从代码...
-
从“Agent 能做对”到“Agent 的测试能抓错”:一个研究备忘录
说明:这是一份早期研究备忘录,用来保存问题意识、方法设想和实验计划
-
GroupedTopK 算子优化入门:从 MoE 路由到 Triton 融合思路
最近开始准备 KernelSwift 算子创新大赛。第一个打算认真拆解的题目是 GroupedTopK:它规模不大,却刚好涵盖 GPU 算子开发里最值得入门的几个主题—— 并行划分、归约、TopK、算子融合、数值稳定性和性能分析
-
MoE 路由入门:从 Dense FFN 到 GroupedTopK
在研究 GroupedTopK 算子之前,我发现自己虽然知道 MoE 的全称是 Mixture of Experts,却没有真正想清楚:expert 到底是什么、router 输出的数字代表什么、TopK 之后数据怎样流动,以及一个看...
-
Serena: 给你的 AI Coding Agent 装上 IDE 大脑
最近 oraios/serena 在 GitHub 上火了——22k+ star,MIT 协议,才一年多就冲到了 AI 编码工具的前排。它的 slogan 很直接:"the IDE for your agent"
-
Grok Build 对话编排系统深度解析:多 Agent 架构的设计哲学
2026 年 7 月 15 日,xAI 开源了 Grok Build——一个 132 万行 Rust、77 个 crate 的终端 AI 编程 Agent。各大媒体都在报道它的安装方式、定价策略和隐私争议,但很少有人深入它的对话编排系统
-
NVIDIA Polar:对任何 Agent Harness 做强化学习
问题:Agent RL 的工程瓶颈 给 LLM Agent 做强化学习,目前面临一个尴尬的工程问题:
-
PICO:双通道隔离的 Transformer 安全架构
问题:system prompt 和用户输入共享同一个 embedding 通道 你现在和 LLM 的每一次交互,system prompt 和日常对话 prompt 都走同一个 tokenizer + embedding 层进入模型...
-
RL for LLMs:从零到完整训练流程
本文从基本概念开始,逐步构建 LLM 强化学习的完整图景
-
einops 实用指南:用可读的方式重排、归约和重复张量
是一个用于张量变换的 Python 库,它把 、、、、、、 等操作统一成一种接近数学记号的字符串表达式。它的核心价值不是"能做原生框架做不到的事",而是让张量操作更可读、更难写错、更容易维护
-
gaokao-math-ds-kickoff
GaokaoMathDS:高考数学 LLM 数据集工程(开篇) 上个月开始构思一个项目:构建一个高质量的高考数学领域数据集,用来微调一个小尺寸 LLM(目标 1.5B7B 级别),看能不能在 MATH、GSM8K 这类 benchma...
-
Saguaro (SSD):把推测解码的「推测」和「解码」也并行起来
论文信息 论文标题: Speculative Speculative Decoding 作者: Tanishq Kumar(斯坦福)、Tri Dao(普林斯顿)、Avner May(Together AI) 发表: ICLR 2026...
-
黄益平:AI对宏观经济的影响——增长、通胀与分配视角
本文转载自北京大学数字金融研究中心「专家观点」栏目
-
黄益平:中国经济压力的本质与战略应对
本文转载自北京大学数字金融研究中心「专家观点」栏目