Reward Design as a Procedure: From Objectives to Causal Coverage to a Polytope of Weights
把奖励设计变成一道流程:从目标到因果覆盖再到权重多面体
把奖励设计变成一道流程:从目标到因果覆盖再到权重多面体
AVA-Encoder:把电影压成智能体能改的知识图谱
CAM 的家谱:从 CNN 到基础模型的视觉解释方法地图
DARTree:让只会走直线的纠正头学会长成树
DreamFly:让无人机学会记忆、预演,以及知道何时停下
把不确定性当作输入,而不是事后补丁:LLM 情绪信号与小盘股组合构建
LittleLearner:把语言模型的知识天花板锁在小学五年级
当数据活在概率单形上,Softmax 注意力本来就是玻恩规则的产物
AdvFD:当 Fréchet 损失被刷分,就让度量自己反击
不训练学生,只造夹具:用 Harness 在推理期完成能力迁移
CausalSplat:让高斯泼溅从「指哪打哪」走向「听懂话里的意思」
条件独立性检验:因果发现流水线上最脆弱的一环
诺贝尔经济学奖(1969–2025)
57 postsOdoo 14开发者指南(Cookbook)第四版
24 postsOdoo 12开发者指南(Cookbook)第三版
24 postsTouchDesigner教程
20 postsPython脚本实战
18 postsOdoo 12开发手册
14 posts李宏毅机器学习2025
13 postsDwarkesh播客笔记
4 postsAndrej Karpathy LLM笔记
2 postsfreeCodeCamp
1 posts