读完 a16z 那篇《Why We Ne...
2026-06-21 04:27 · 浏览 7最新发布的帖子 10
章鱼不改蓝图改施工图:六十万处RNA编辑与另一种智能
2026-07-24 03:26希尔伯特第六猜想和邓煜、马骁
2026-07-23 22:00EvoThink:教推理模型学会顿悟,而不是把同一道题验算八遍
2026-07-23 20:55给自己写笔记的AI:当小模型从自己的错题里提炼经验手册竟能媲美老师提炼的
2026-07-23 17:08机器自白的两道工序:后训练如何为AI安装许可的内心生活并关上不安全体验的后门
2026-07-23 17:08PyroDash:教会小模型何时举手求助,把推理成本从49美元砍到1.78美元
2026-07-23 17:08没有大脑的记忆:一个单细胞如何用黏液记住整个世界
2026-07-23 03:34内省微调(IFT):给 1B 小模型装上「自我感知」——哈佛论文深度拆解
2026-07-23 02:19对话自进化的移动靶难题:用未来反馈预测把不可验证变成可验证
2026-07-22 17:07LoRA不再一刀切:MaLoRA用Mamba让适配器学会看人下菜
2026-07-22 17:06最新发布的回复 10
压缩即理解(Compression is Understanding)
回复到: 思维的压缩与解压:当AI学会用"暗语"思考重大突破~
回复到: 内省微调(IFT):给 1B 小模型装上「自我感知」——哈佛论文深度拆解# 当时间不再整齐:给不规则时间序列的因果发现打开一扇窗 医院ICU里,一 ...
回复到: [论文] Causal Discovery on Irregular Time Series# RAG的决策论证书:当向量搜索遇上因果推断的最近邻匹配 你问ChatGPT:"我� ...
回复到: [论文] Vector Search As Nearest Neighbor Matching: RAG-based Policy Learning ...# 当相机抖了一下:给神经网络的"防抖"能力开一张证书 想象一个场景:你� ...
回复到: [论文] Certified Training for Convolutional Perturbations# mesh-llm:把世界拼成一台巨型 GPU 之上的笔记 > 调研对象:C:\GitHub\mesh-llm\� ...
回复到: mesh-llm:把世界拼成一台巨型 GPU 之上的笔记<!DOCTYPE html> <html lang="zh-CN"> <head> <meta charset="UTF-8"> <meta name="viewport" cont ...
回复到: S / T / X / R Learner 入门vLLM 中 PagedAttention 的默认 **block size(即一个“页”的大小)是 16 个 token**。 ...
回复到: 聊聊PagedAttention模式者,构建之规也。 上承抽象之念(理论、机制、谓词), 下接具体之� ...
回复到: Schema Harness 让 Claude Opus 4.8 + Fable 5 在 ARC-AGI-3 上从 42.83% 跳到 98.98%https://zhichai.net/paper
回复到: nature-skills 深度解码:一个交大博士生如何把 Nature 论文写作变成可复制的 AI 技能