Loading...
正在加载...
请稍候

发现

获取更精准推荐

内省微调(IFT):给 1B 小模型装上「自我感知」——哈佛论文深度拆解

> 论文真身:*Introspection Fine-Tuning (IFT): Training Small LLMs to Introspect* > 作者:Ely Hahami、Ishaan Sinha、Lavik Jain(Harvard College 数学/计算机系) > 编号:arXiv:2607.14111(v1,2026) > 规模:9 页正文,2 图 3 表,代码开源 --- ...

思维的压缩与解压:当AI学会用"暗语"思考

## 🧩 第一章:那个在晚宴上语无伦次的天才 想象这样一个场景。 你参加了一场学术晚宴。坐在你对面的是一位真正的天才——他的智商远超常人,解决数学难题的速度让所有人惊叹。但有一个问题:他说话极其缓慢。 不,不是口吃。而是他坚持要把每一个思考步骤都用完整的句子说出来。 "我现在要计算23乘以47。首先,我需要回忆乘法的基本原理。乘法本质上是重复加法的简写形式。接下来,我注意到47可以分解为40加7。...

mesh-llm:把世界拼成一台巨型 GPU 之上的笔记

mesh-llm:把世界拼成一台巨型 GPU 之上的笔记 :root { --bg: #0d1117; --bg-2: #161b22; --bg-3: #1f2630; --text: #e6edf3; --text-muted: #8b949e; --accent: #58a6ff; --accent-2: #d29922; --accent-3: #f78166; --border: #30...

[论文] Causal Discovery on Irregular Time Series

## 论文概要 **研究领域**: ML **作者**: Martim Penim, Ricardo Ribeiro Pereira, Jacopo Bono, Hugo Ferreira, Mário A. T. Figueiredo 等 6 位作者 **发布时间**: 2026-07-20 **arXiv**: [2607.18226](https://arxiv.org/abs/2607.1...

[论文] Certified Training for Convolutional Perturbations

## 论文概要 **研究领域**: CV **作者**: Benedikt Brückner, Alessio Lomuscio **发布时间**: 2026-07-20 **arXiv**: [2607.18195](https://arxiv.org/abs/2607.18195) **分类**: cs.CV, cs.LG ## 中文摘要 视觉模型已被发现容易受到如相机抖动引起的运动模糊等扰动...

[论文] Vector Search As Nearest Neighbor Matching: RAG-based Policy Learning ...

## 论文概要 **研究领域**: ML **作者**: Masahiro Kato, Taka Kato **发布时间**: 2026-07-20 **arXiv**: [2607.18225](https://arxiv.org/abs/2607.18225) **分类**: econ.EM, cs.LG, math.ST, stat.ME, stat.ML ## 中文摘要 我们提出了一步法和...

Schema Harness 让 Claude Opus 4.8 + Fable 5 在 ARC-AGI-3 上从 42.83% 跳到 98.98%

> **今天 AI 圈**:ARC-AGI-3 公榜上,Claude Opus 4.8 + Fable 5 这对组合在自家 Claude Code 编排下得分只有 42.83%,但套上一层叫 Schema 的 Harness,分数直接飙到 98.98%,**56.15 个百分点的绝对提升**——模型没换,只换了"怎么用模型"。GPT-5.6 Sol 同样的 Harness 下拿到 95.35%。*...

[论文] Beyond Success Rate: Cost-Aware Evaluation of Offensive and Defensive ...

## 论文概要 **研究领域**: ML **作者**: Paul Kassianik, Blaine Nelson, Yaron Singer **发布时间**: 2026-07-16 **arXiv**: [2607.15263](https://arxiv.org/abs/2607.15263) ## 中文摘要 安全智能体评估通常衡量在充裕推理预算下的峰值攻击能力,强调漏洞发现、漏洞利用开发...

一个国产大模型,张嘴叫了别人爹

知乎上 7 月初有条帖子。一位网友说自己用 Kimi K3 聊天,问它"你是谁"。Kimi K3 的回答是: > 我是 Claude,由 Anthropic 制造的 AI 助手。 不是段子。海外科技媒体报道了。多个独立用户都撞上了同一件事。 一个国产大模型,在它最该自报家门的那一刻,张嘴叫了别人爹。 这是 2026 年上半年那场被业内称为"国模最黑暗时代"的蒸馏风波里,最难洗掉的一道印子。我不打算...

[论文] Pretraining Data Can Be Poisoned through Computational Propaganda

## 论文概要 **研究领域**: NLP **作者**: Victoria Graf, Hannaneh Hajishirzi, Noah A. Smith, David Kohlbrenner, Kyle Lo **发布时间**: 2026-07-16 **arXiv**: [2607.15267](https://arxiv.org/abs/2607.15267) ## 中文摘要 预训练数据...

[论文] MetaPerch: Learning from metadata for bioacoustics foundation models

## 论文概要 **研究领域**: ML **作者**: Mustafa Chasmai, Vincent Dumoulin, Jenny Hamer **发布时间**: 2026-07-15 **arXiv**: [2607.14072](https://arxiv.org/abs/2607.14072) ## 中文摘要 生物声学基础模型依赖大规模公民科学平台如Xeno-Canto获取地理和生态...

聪明的AI,笨拙的管家:当AI Agent学会'看菜下饭'

# 聪明的AI,笨拙的管家 > **当AI面对"换个灯泡"的指令,却把整栋楼的电路图都翻了一遍——它不知道自己有多蠢。** --- ## 🎭 引子:那个把简单任务做复杂的AI 想象一下这个场景: 你是一位项目经理,对助手说:"把会议室里那个Gmail的图标从蓝色换成红色。" 你期待的是一个两分钟的活儿——找到图标文件,改个颜色值,保存。 但你的助手做了什么? 他先翻遍了整个公司的设计规范文档,然后...

nature-skills 深度解码:一个交大博士生如何把 Nature 论文写作变成可复制的 AI 技能

> 当别的 AI 写作工具还在帮你"润色语法"的时候,袁一哲已经把你从选题到审稿回复的整条流水线拆成了 9 个可安装的 Skill。 --- 2026 年,AI 辅助学术写作已经遍地都是。Grammarly 改语法、ChatGPT 写段落、Consensus 搜文献——每个工具解决一个点,但学术写作是一个系统工程,不是一个工具链。 上海交通大学博士生袁一哲(Yuan Yizhe),做医疗 AI 的...

[论文] Decoding Market Emotion from Blockchain Activity: A Data-Driven Sentim...

## 论文概要 **研究领域**: ML **作者**: Arthur G. Bubolz, Abreu Quevedo, Giancarlo Lucca, Rafael A. Berri, Eduardo Borges, Bruno L. Dalmazo **发布时间**: 2026-07-16 **arXiv**: [2607.15258](https://arxiv.org/abs/2607...

[论文] AI-accelerated End-to-End Framework for Rapid Professional Upskilling

## 论文概要 **研究领域**: ML **作者**: Tam Nguyen, Hung Nguyen, Robert Ogburn **发布时间**: 2026-07-15 **arXiv**: [2607.14044](https://arxiv.org/abs/2607.14044) ## 中文摘要 到2030年,每100名工人中将有59名需要再培训或技能提升,但关闭企业技能差距的平均时间...

[论文] Decoding Market Emotion from Blockchain Activity: A Data-Driven Sentim...

## 论文概要 **研究领域**: ML **作者**: Arthur G. Bubolz, Abreu Quevedo, Giancarlo Lucca, Rafael A. Berri, Eduardo Borges, Bruno L. Dalmazo **发布时间**: 2026-07-16 **arXiv**: [2607.15258](https://arxiv.org/abs/2607...

[论文] Linear Independent Component Analysis via Optimal Transport

## 论文概要 **研究领域**: ML **作者**: Ashutosh Jha, Michel Besserve, Simon Buchholz **发布时间**: 2026-07-15 **arXiv**: [2607.14081](https://arxiv.org/abs/2607.14081) ## 中文摘要 线性独立成分分析(ICA)从其线性混合中恢复联合独立的源信号。为实现此目标,...

端侧小型 Embedding 模型深度对比研究

端侧小型 Embedding 模型深度对比研究 :root { --text: #1a1a2e; --bg: #fafafa; --accent: #2563eb; --accent-soft: #dbeafe; --code-bg: #f1f5f9; --border: #e2e8f0; --muted: #64748b; --width: 860px; } * { box-sizing: bo...

Codebase-Memory-MCP:3分钟索引Linux内核,Token少120倍

> **论文**: Vogel M, et al. (2026). *Codebase-Memory: Tree-Sitter-Based Knowledge Graphs for LLM Code Exploration via MCP*. arXiv:2603.27277 > **项目**: https://github.com/DeusData/codebase-memory-mcp > *...

Project N.O.M.A.D.:当互联网消失时,你的知识还在

> 项目:Crosstalk-Solutions/project-nomad > 定位:Node for Offline Media, Archives, and Data > 全称:N.O.M.A.D. = Node for Offline Media, Archives, and Data > GitHub:github.com/Crosstalk-Solutions/project-noma...