LoopDNS资讯播报
70.9K subscribers
2.73K photos
357 videos
137 files
7.99K links
LoopDNS 综合资讯---简洁,及时,快速,准确


频道: @DNSPODT

电报讨论组: @LoopDNS

撤稿流程: https://t.me/loopdns/107752
Download Telegram
中共中央 全国人大常委会 国务院 全国政协讣告 朱镕基同志逝世

中国共产党中央委员会、中华人民共和国全国人民代表大会常务委员会、中华人民共和国国务院、中国人民政治协商会议全国委员会沉痛宣告:中国共产党的优秀党员,久经考验的忠诚的共产主义战士,杰出的无产阶级革命家、政治家,党和国家的卓越领导人,中国共产党第十四届、十五届中央政治局常委,国务院原总理朱镕基同志,因病医治无效,于2026年8月12日11时06分在北京逝世,享年98岁。
🙏224🕊67🍾29🎉13💩6😁5😢3😴31👍1🤮1
‼️huge ssi news.

ilya is about to take his first tentative steps out of the age of research and back into the age of scale. it’s time to smell what ssi is cooking.

ssi have built a small reasoning engine that can compete with much larger training runs because his data is better curated to meta learning. but, more importantly.

we’re about to step into the era of TTT (test time training. gradient descent happening in real time to solve your problems). so instead of a context window you get actual learning.

and because it’s so sample efficient it can be trained on hard to verify tasks that other paradigms can’t touch. everyone else’s weights are frozen, they struggle out of distribution. ssi have created something that has a bundle of knowledge but can truly learn in real time and use that to your advantage.

current approaches are trying to hack their way to ‘learn’ with memory trick......


我们正在步入 TTT(Test-Time Training,测试时训练)的时代:梯度下降将在推理过程中实时发生,模型不再只是从上下文中检索和组合已有信息,而是能够在解决问题的过程中真正完成学习。换言之,我们获得的不再仅仅是一个不断扩大的上下文窗口,而是一种可以持续更新自身的学习机制。
正因为这种机制具有极高的样本效率,它有望被应用于那些难以验证、因而长期难以用于训练的任务。传统模型的参数在部署后基本保持冻结,一旦面对分布外问题,往往只能依赖已有知识和上下文进行推断;而 SSI 所构建的系统则不同:它既拥有广泛的知识基础,又能够在面对新问题时实时学习,并将新获得的经验直接用于后续推理。
目前的许多方案都在试图借助记忆、检索等机制模拟“学习”,但这种系统所做的事情更加直接:它会真正更新自身的权重,保留关键经验,并有望逐渐形成更加接近人类的持续性推理能力。这不仅是对现有技术路线的一次改进,更可能意味着整个范式的转变。


Source
🤔37👍5🤮1💯1
xAI 发布 Grok 4.6,强化长程 Agent 与交互式开发能力
2026 年 8 月 12 日,xAI 正式发布 Grok 4.6。新模型在 Grok 4.5 基础上继续强化长时间运行的 Agent、复杂多步骤任务,以及交互式和视觉应用开发能力。xAI 称其可持续完成研究、信息分析、大型代码库操作以及从想法到完整应用的开发流程。

训练方面,Grok 4.6 进行了比 4.5 更长的补充训练,并加入模型生成的推理与技术数据、高质量工程数据,同时更新优化器和训练方法。后续 SFT 数据由 Grok 4.5 重新生成,并在知识工作、通用编程、Kernel 优化、Web 开发和 CAD 等环境中进行了 Agentic RL。

在 xAI 公布的评测中,Grok 4.6 High 的 Artificial Analysis Intelligence Index 得分为 61,与 GPT-5.6 Sol Max 持平;CursorBench 3.2 为 69.9%,FrontierCode 1.1 Extended 为 61.3%。这些结果包含 xAI 自测以及公开的第三方模型成绩,仍应结合独立评测看待。

Grok 4.6 已上线 Grok Build、Cursor、xAI API,并通过 OpenRouter、Vercel 和 Cloudflare 等平台提供。API 起价为每百万输入 Token 2 美元、每百万输出 Token 6 美元,另有速度更快、价格翻倍的版本。

来源:xAI 官方公告《Introducing Grok 4.6
👍30🤡41🔥1🤮1🤗1
deepseek v4pro上新?
🥰70🐳574🤡2🤮1💩1🖕1
DeepSeek V4 Pro 正式版上线,重点强化 Agent 能力

2026 年 8 月 13 日,DeepSeek 正式发布 DeepSeek V4 Pro 正式版,模型版本更新为 DeepSeek-V4-Pro-0813。目前已同步上线 DeepSeek App、网页端和 API,网页及 App 用户可通过“专家模式”使用。API 原有 deepseek-v4-pro 模型名保持不变,将自动指向新版本。

本次更新重点提升 Agent 能力。DeepSeek 表示,新模型在实际生产环境中的表现有明显改善。API 同时原生支持 Responses API、Tool Calls 和 Anthropic API,并针对 Codex 等 Agent 工具进行了适配。V4 Pro 支持 low、high、max 三档思考强度,默认开启思考模式并使用 high。
模型继续提供 1M Token 上下文,单次最大输出为 384K Token。DeepSeek 还将于北京时间 8 月 17 日 0 时启用新的峰谷定价,V4 Pro 高峰期每百万 Token 缓存未命中输入 / 输出价格分别为 9 元和 27 元,空闲时段降至 4.5 元和 13.5 元。

来源:DeepSeek API 官方文档
👎81🐳18😭7🥴21👍1🎉1🤮1🖕1
DeepSeek 开源 DeepSeek Harness,进入开发者预览

DeepSeek 正式公开自研 Agent Harness「DeepSeek Harness(dsh)」代码,目前处于 Developer Preview 阶段,并采用 MIT 许可证开源。官方同时提醒,该项目仍在快速迭代,后续可能出现破坏兼容性的更新。

DeepSeek Harness 定位为通用 Agent 运行框架。其底层基于 Cordis,采用高度插件化架构,包括模型适配器、工具注册、会话日志和 Agent Loop 在内的核心组件均可替换或扩展。官方提供 Web UI 与 Headless 等运行方式,并支持工作区文件读写、命令执行、任务规划、子 Agent 委派以及权限审批。

此前 DeepSeek 已在 V4-Flash 的官方更新中披露,其 Code Agent 公开基准测试使用 DeepSeek Harness minimal mode。随着 Harness 源码公开,DeepSeek 在模型之外的 Agent 执行框架也开始正式向开发者开放。

目前可直接通过 npm 启动 Web UI:
npx @deepseek-ai/dsh web

来源
👌31👍19🐳75🖕3🤮2
Google 推出 Gemini 3.7 Flash
🤣87💩217😭3👍2🤮1🤡1🥴1🍾1
MiniMax Music 3 正式开放权重,支持最长 5 分钟完整歌曲生成

8 月 14 日,MiniMax 正式公开音乐生成模型 MiniMax Music 3 的模型权重及本地推理方案,模型已上线 Hugging Face,官方 GitHub 仓库同步开放。模型文件规模约 57.4 GB,并已支持 SGLang-Omni、Hugging Face Diffusers 和 ComfyUI 等推理方案。

Music 3 面向完整歌曲生成,支持歌词与音乐描述联合控制,单次可生成最长约 5 分钟的歌曲,并维持长程的旋律主题、节奏、演唱音色和编曲结构。模型采用分层架构,其中 8B Global LLM 负责长程音乐结构,0.6B Local LLM 负责局部声学细节,后端结合 2.4B Flow Matching 与 Flow-VAE,最终输出 32 kHz、16-bit 立体声 WAV 音频。Global LLM 基于 Qwen3-8B 初始化。

官方同时给出了相对低显存的本地部署方案。Diffusers 完整精度运行适合 24 GB 以上显存,在 CPU Offload 下约需 22 GB 显存,进一步采用逐层流式卸载后可在约 8 GB 显存的 GPU 上运行,但推理速度会明显降低。

MiniMax Music 3 采用自定义的 MiniMax-Music3 Community License,并非 Apache 2.0 或 MIT 等宽松许可证。许可证允许使用、修改和分发模型,但商业产品需要显著标注“MiniMax-Music3”;相关产品或服务年收入超过 2000 万美元时,还需要获得 MiniMax 的额外书面授权。

来源:MiniMax 官方 Hugging Face 模型页
46🆒6👍3👎2🤮1🖕1
特朗普签署公告,以应对国家安全威胁为由对进口无人机及零部件征收10%至100%的从价关税。公告规定,对具有高度敏感性的特定尺寸或特定功能的无人机,以及此类无人机的停靠站和某些关键组件,征收100%的从价关税。该类别包括最大起飞重量超过25公斤的无人机以及具备热成像功能的无人机。

对尺寸较小且不具备特定功能的某些无人机及其他无人机组件,征收25%的从价关税。

对来自欧盟、日本、列支敦士登、韩国和瑞士等的无人机及组件征收15%的从价关税。此外,对来自英国的无人机征收10%的从价关税,前提是其硬件、软件和技术基本上均源自上述国家和地区,以及美国。

规定称,上述关税将于签署之日起21天后生效。对于非高度敏感的无人机组件,关税将于签署之日起180天后生效。

来源:外汇交易员
🤣21🤡11👍3🤮1
严重/需要注意的:爱快(iKuai)路由系统疑似存在远程利用漏洞,部分用户反馈 DNS 遭篡改。

8月13日至8月14日,有爱快(iKuai)用户在论坛集中反馈,其路由设备的 DNS 配置在未经管理员操作的情况下被异常修改,部分用户随后出现网页访问内容被劫持、跳转异常等现象。

目前用户反馈的异常特征具有较高一致性:受影响设备的首选 DNS 被修改为 43.98.194.101,备用 DNS 被修改为 43.98.163.207;同时,系统中的 DNS 加速服务被开启“第三方代理模式”,其中上游首选 DNS 同样被设置为 43.98.194.101

需要关注的是,部分用户在发现异常后手动将 DNS 修改回正常地址,但仅数分钟后,DNS 配置又会被自动重新篡改为上述两个 IP

从目前收集到的案例来看,受影响版本主要集中在 iKuai 3.7.19~3.7.22,涉及范围并不限于单一硬件平台,X86 自建软路由以及爱快官方硬件路由设备均有用户反馈出现相同的 DNS 篡改现象

频道编辑在收集了多名用户检查系统登录日志、安全日志及相关操作记录后,未发现明显的异常登录 IP、入侵来源 IP或管理员登录操作记录。在部分设备的进程及系统日志中,异常发生时间附近唯一较为明显的记录为 DNS 服务重新启动。结合“手动恢复后数分钟内再次被篡改”的现象,目前不能排除设备内部存在异常进程、远程控制机制或某种周期性配置下发行为,但具体攻击路径仍有待进一步取证确认。

此外,43.98.194.10143.98.163.207 两个异常 DNS IP 均指向新加坡地区的阿里云服务器资源。根据部分公开安全情报结果发现这两个 IP 曾出现疑似恶意活动或攻击相关记录,但其与本次事件之间是否存在直接关联,仍需要进一步的技术取证和官方确认。

注意: 目前尚不能确认该事件究竟由爱快系统本身的远程代码执行漏洞、认证绕过、管理接口漏洞、供应链问题、异常组件或其他攻击途径导致。但多个不同网络环境、不同硬件平台的用户在短时间内出现高度一致的配置篡改行为,且手动恢复后仍会在数分钟内再次遭到修改,同时传统登录日志中没有留下明显攻击来源记录。
34😨22🤡11😁7🍾3🐳2🤮1🖕1
微软战略性收缩中国业务,重心转向服务中国企业出海
在过去五年里,微软已关闭至少15家中国分支机构和合资企业。五名微软内部人士表示,公司正在推进一项可被描述为“战略性收缩”的计划。

消息人士称,微软曾在2023年认真考虑退出中国市场,因为部分高管认为,公司承担了过多地缘政治风险,却只获得有限经济回报。不过他强调,微软目前并无退出中国的计划。微软曾表示,2024年中国市场收入仅占其全球营收的1.5%。

这五名人士表示,中美两国互信恶化对微软造成了重大冲击。自2017年以来,中国一直推动采用本土软件,北京方面认为国产软件更安全,而且其质量正越来越接近Windows和Office等产品。与此同时,美国的各项限制措施,包括先进技术出口管制,也阻碍了微软在中国扩大其高利润AI和云计算业务的努力。

三名知情人士表示,微软最终决定继续留在中国,原因之一是其已建立起一项盈利能力良好的业务,为字节跳动等中国企业提供服务。这些企业在海外运营中需要借助西方技术。另有两名人士表示,微软还认为,公司需要保留在华存在,以持续接触中国世界领先的工程师人才资源。

来源:外汇交易员
😢39🍾15🤮6👏2
苹果联手阿里巴巴为其中国市场开发专属大模型

据路透社报道,消息人士透露,苹果公司在阿里巴巴的技术支持下,为其中国市场训练了一款专属的大语言模型。此举改变了苹果此前完全依赖本土第三方模型的策略,使其能够更好地掌控在中国市场的AI体验。

该自研模型已获得相关监管备案,预计随着系统更新,Apple Intelligence 服务将于未来几个月内在中国市场推出,以应对来自华为等本土品牌的激烈竞争。

来源:路透社
🤣58👍17🤡8🎃4💩3🖕21🤮1
中国7月社融增量超预期 新增人民币贷款现罕见收缩

中国人民银行8月14日发布的数据显示,2026年7月新增社会融资规模达1.41万亿元,高于市场普遍预期的1万亿元,政府债券发行成为推动社融增长的主要力量。今年1至7月,社会融资规模增量累计为22.25万亿元。

与此同时,受实体经济及居民信贷需求疲软影响,7月人民币贷款减少3400亿元,出现罕见缩减。分析指出,随着我国经济逐步向科技和创新驱动转型,对传统贷款的依赖度有所下降,债券融资在整体信用结构中的占比正持续上升。

来源:彭博社 / 中国人民银行
😁60🎉211🥰1🤩1🤮1🍾1
Z.ai 发布 GLM-5.3

2026 年 8 月 14 日,Z.ai 正式发布旗舰模型 GLM-5.3。该模型沿用 GLM-5.2 的基础模型,主要能力提升来自后训练阶段,重点面向复杂软件工程、长程 Agent 任务与网络安全场景。官方文档显示,GLM-5.3 支持 100 万 token 上下文和最高 128K token 输出。

Z.ai 称,GLM-5.3 在内部 Z.ai Code Bench 上相比 GLM-5.2 提升约 50%。公开测试中,Terminal-Bench 3.0 从 4.6 提升至 28.3,DeepSWE v1.1 从 46.2 提升至 66.9,Agents' Last Exam CLI 从 23.8 提升至 28.5。

网络安全能力是此次更新的另一重点。GLM-5.3 在漏洞发现测试 CyberGym 上取得 84.5%,官方对比数据显示 Mythos 5 为 83.8%、GPT-5.6 Sol 为 83.6%;ExploitBench 则从 GLM-5.2 的 24.4% 提升至 54.4%。Z.ai 同时承认,其当前优势更多集中在漏洞发现和利用链前端,完整攻击利用能力仍存在差距。

目前 GLM-5.3 已向 GLM Coding Plan 用户开放,通用 API 仍标记为即将上线。模型权重尚未公开,Z.ai 表示将在发布约两周后、完成进一步安全评估和加固后开放权重。

来源
👍36🤡83🥰2🤮1🖕1
宏观边际MacroMargin

中国7月有效贷款需求依然低迷,企业和居民新增中长贷,双双为负,贴着过去十年最弱的下限。

当然,贷款需求弱,这将会是以后的常态。

潘功胜在6月陆家嘴论坛也已经定调,宣告中国进入“直接融资”时代(债券和股票等融资比例首次超过贷款),

并明确说“没有必要”再让贷款保持过去增速,说“降速提质”或将成为宏观运行的新常态之一”

贷款弱点就弱点吧,无所谓的...
👍39🤡188🔥1🤮1🍾1👀1
SpaceX完成对AI软件Cursor的并购
👍27👎5🤔1🤮1
社区消融实验揭秘:DeepSeek V4 Pro 严重依赖首轮工具锚定,两阶段插件成功复现高分能力

DeepSeek V4 Pro 正式版发布后,因实际表现不及灰度测试预期而引发社区争议。近日,开源社区通过消融实验探针对其进行了深入分析,揭示了其性能波动的底层机制并给出了解决方案:

V4 Pro 对首轮请求中可见的 API 工具目录(Schema Surface)极度敏感。在暴露完整 25 个工具的 Standard 模式下,模型易陷入低效的 “Let me...” 思维链(CoT)轨迹,Project2 评分仅为 9192 分;而在仅提供 Shell 和 Read 的 Minimal 模式下,模型能被激活为灰测时的 “We need...” 推理轨迹,基准分回升至 9699 分。

针对 Minimal 模式缺失高级工具的问题,社区开源了 dsh-anchored-standard 插件。该方案采用“首轮锚定 + 动态晋升”策略——首次请求仅暴露 2 项核心工具以锚定优质推理轨迹,一旦模型发起首次 Tool Call,立即在后续轮次解锁全部 25 项标准工具。

在 Windows 原生 Project2 测试中,该方案连续跑出 98、99 的高分,成功进入 Fable 等前沿模型分数带。该实验表明,V4 Pro 的核心能力并未丢失,但可能在强化学习(RL)后训练阶段对特定的 Harness 脚手架与工具暴露环境存在显著过拟合。

参考:microblock_pubDeepSeek V4 Pro / Flash 轨迹触发机制实验dsh-anchored-standard
💩86😁3513👍2🖕2🤮1