&'a ::rynco::UntitledChannel
4.39K subscribers
17.3K photos
280 videos
123 files
14.7K links
西郊林密无处去,北城雾沉晚风凉。

本频道是:
- 推送任何有趣的东西的地方
- 偶尔可以看纸片小姐姐的地方
- 管理员随性吐槽的地方

本频道不是:
- 客观的科技新闻频道
- 键政频道

转载不代表立场。
消息仅代表发布者个人观点,不代表其他管理员的观点或立场。
本频道不接收任何广告。

所有原创内容以 CC BY-NC 4.0 发布。

其他
音乐频道 @rynif_music
Download Telegram
👀2
鸦 (2)
鸦 (3)
👀2
一秒猜到相机品牌
😇15🤓2
Forwarded from 老周部落运营中心
2026 Linux 重置密码教程大全
- Dirty Cow (CVE-2016-5195)
- Dirty Pipe (CVE-2022-0847)
- io_uring UAF (CVE-2022-2602)
- Copy Fail (CVE-2026-31431)
- io_uring ZCRX freelist (CVE-2026-43121)
- Dirty Frag (CVE-2026-43284 CVE-2026-43500)
- Fragnesia (CVE-2026-46300)
Ref: https://x.com/hsn8086k/status/2054798542062109001
🤡6🤣32😁1
PL Nerd 迎来惊天大变,Vibe Coder 喜提 AI 原生
https://zhuanlan.zhihu.com/p/2039725076204016063

可能有订户觉得咱是 mbt 黑子(咱不否认),但是咱看完这篇文章之后只想给 mbt 郑重道歉。

我要洗眼睛!!!!
😁19🤯6
Forwarded from Hacker News
Who will buy your services if you fire us all? (🔥 Score: 151+ in 1 hour)

Link: https://readhacker.news/s/6Upnx
Comments: https://readhacker.news/c/6Upnx
佐倉まさち🌸:
・なかよしのやつ
・めでたし
・Ex-Otogibanashi
・かぐやっほー
・KASSEN
・パスタ

超かぐや姫には隠語が多すぎる
#超かぐや姫

https://twitter.com/masamasan/status/2056575188805070933
Forwarded from rami3l
🥰5
Forwarded from Hacker News
Show HN: Number Gacha, a gacha game distilled to its essence (❄️ Score: 151+ in 5 days)

Link: https://readhacker.news/s/6U3tH
Comments: https://readhacker.news/c/6U3tH

Number Gacha is a half-parody, half-real gacha game where you roll, unwrap, and battle numbers. Play on Desktop for the best experience!
TL;DR: 大模型只看多选题的选项不看题干,也能以高于随机的比例答对问题,并且主要是以猜测题干的方式达成的。

https://fixupx.com/NishantBalepur/status/2056359665802322291?s=20

测试时推理模型是有策略的多项选择题答题者

https://arxiv.org/abs/2510.07761

大型语言模型(LLM)现在会在回答前给出推理过程,并在多项选择问答(MCQA)等任务上表现出色。然而,一个值得担忧的问题是,LLM 可能并不是按照预期方式来解答多项选择题的:已有研究发现,即使不给 LLM 推理过程,它们也能在不使用题干、只看选项的情况下成功完成 MCQA,也就是所谓的“仅选项”输入。这种基于部分输入取得成功的现象,通常会被归因于一些浅层、微不足道的捷径;但推理轨迹或许可以揭示,这些“仅选项”策略是否真的如此浅薄。

为考察这些策略,我们让具备推理能力的 LLM 分别在完整输入和“仅选项”输入下解答多项选择题。结果发现,测试时推理通常会提升完整输入下的准确率,并且在大约一半情况下,也会提升“仅选项”输入下的准确率。尽管这可能源于浅层捷径,但“仅选项”成功率几乎不受推理轨迹长度影响;并且在发现这些推理轨迹通过了忠实性测试之后,我们进一步表明,它们使用的是问题较少的策略,例如推断缺失的题干。

总的来说,我们质疑“基于部分输入的成功总是一种缺陷”这一说法。因此,我们提出:推理轨迹可以用来区分有问题的数据与相对不那么有问题的推理。