Blog
Blog posts about the papers I read and my thoughts on them.
2026
How do world (action) model facilitate manipulation policy
generalizability data efficiency World Model
最小二乘和岭回归
有一组数据 $(X,Y)$, 我们猜测 $X$ 关于 $Y$ 线性,即,存在一组参数 $\beta$, 使得 $X=Y\beta$. 最小二乘法直接去最小化估计偏差,定义损失函数 $J(\beta) = \Vert{}Y - X\beta\Vert{}2^2$ 从而可以得到 $\beta^*$ 的解析解 $\h...
Hardworking
可以说,直到大三之前,我都自诩为普通人中比较聪明的那一类。我从没有特别努力争取过什么,但也总能稀里糊涂取得还不错的成绩,于是我便欣然接受这种幸运,仗着一点“悟性”偷点懒,反正我自以为胸无大志,不过想要安然做自己喜欢的事。 然后我意识到,命运之神不会永远眷顾我,我的“小小志向”也绝非唾手可得。我承认了我的贪婪。于是...
各种优化器
本文以做motion planner/IK solver的视角写作。
The sim to real gap
什么是sim 2 real gap? 为什么这是一个重要的问题? 体现在哪些方面? 有哪些方案尝试解决?
Harness是什么?
ref: 于超老师的对谈 https://mp.weixin.qq.com/s/KSXKy7nVAQ8eshrBRtGnUA Lili Weng’s blog: https://lilianweng.github.io/posts/2026-07-04-harness/
具身操作数据和跨本体的交互表示
此文暂时搁置,因为这个题目太大了。我现在拥有的经验知识有点少,缺乏再次问题中自己的落点,现在去读文献和归纳,只是文本层面的综述,意义不大。
How Do Vlas Assign Actions
#笔记 Code as Policies
Flow Matching
ref: https://diffusion.csail.mit.edu/2026/docs/lecture_notes.pdf 非常有启发,读了好几遍每次都有新收获。
Signed Distance Field
REF NSDF-EmergentMind
C Cpp Compile
What are c/cpp
Manipulation affordance
2020 where2Act Partnet-Mobility python==3.8
Action model
直接生成joint control signal 而非使用优化方法来计算IK,这个事情为什么成立?
Serl
RL policy–RLPD
强化学习
#笔记 #AI-assisted 动手学习强化学习
First Blog
test