simonwillison 最先提出的测试方案,提示词:
Generate an SVG of a pelican riding a bicycle
效果
grok 4.6
grok 4.5
参考
- simonwillison 鹈鹕SVG生成, https://simonwillison.net/2024/Oct/25/pelicans-on-a-bicycle/
simonwillison 最先提出的测试方案,提示词:
Generate an SVG of a pelican riding a bicycle
grok 4.6
grok 4.5
参考 AIClient-2-API README-ZH.md 的「Grok Cookie/SSO 配置」章节。
获取步骤:
sso 字段的值。GROK_COOKIE_TOKEN 字段。GROK_USER_AGENT 与你获取 Cookie 时使用的浏览器 User-Agent 一致,否则可能被 Cloudflare 拦截导致 403 错误。支持功能:
如果遇到 403 错误,可参考 README 中的 TLS Sidecar 配置 章节开启 TLS 指纹绕过。
添加自定义模型,最好自己部署个网关(cc-swich,sub2api等),配置里添加网关地址就行,在网关里配置模型和订阅更方便,apiType使用chat-completions,responses在vscode里不支持,或者部分功能无法使用
1 | { |
比如function call或报错400
Request Failed: 400 {“error”:{“message”:”function_call_output requires item_reference ids matching each call_id on HTTP requests; continuation via previous_response_id is only supported on Responses WebSocket v2”,”type”:”invalid_request_error”}}: Err
这是因为:
1 | 这个报错基本可以确定是 **Grok / xAI Responses API 的 Function Calling 状态续接方式出了问题**。 |
问题在于:HTTP 模式下,xAI 对 function_call_output 的上下文引用有额外要求,而 previous_response_id 这种续接方式目前属于 WebSocket v2 的能力。
xAI 官方文档对 WebSocket 模式明确说明:在 WebSocket 上可以通过:
1 | { |
继续对话。(SpaceXAI)
而 xAI 官方 Function Calling 的 HTTP 示例虽然也展示了 previous_response_id,但你这个错误说明你当前实际使用的 HTTP 接口/版本已经要求 function call output 带对应的 item reference,而不是单纯依赖 previous_response_id。(SpaceXAI)
如果你现在代码类似:
1 | response = client.responses.create( |
不要继续这么做。
不要依赖:
1 | "previous_response_id": "xxx" |
而是把上一轮的 response.output 中相关的 function_call item 一起带上:
1 | response = client.responses.create( |
但这里有一个关键点:
你需要确认你实际使用的 xAI API 版本对 item_reference 的字段名和格式要求。
因为你这个错误不是普通的 call_id 不存在,而是明确提示:
1 | function_call_output requires item_reference ids matching each call_id |
也就是说服务端正在要求:
1 | function_call_output |
如果你这个 Grok 是用于 Coding Agent / MCP / 自动执行工具 / 多轮 Function Calling,我反而建议直接用 xAI 的 Responses WebSocket v2。
官方就是针对这种场景设计的:
agentic workloads with many sequential tool calls
(SpaceXAI)
流程:
1 | WebSocket |
续接时:
1 | { |
这是 xAI 官方 WebSocket 文档给出的模式。(SpaceXAI)
还有一个非常值得检查的地方。
如果你的代码是:
1 | from openai import OpenAI |
然后:
1 | client.responses.create(...) |
那么你实际上是在使用 OpenAI SDK + xAI Responses API。
这种情况下尤其容易出现:
1 | OpenAI SDK |
xAI 官方目前仍提供 OpenAI SDK 兼容方式,所以 SDK 本身不一定有问题,但 Responses API 的 HTTP/WebSocket 行为不能完全按照 OpenAI 的实现假设处理。(SpaceXAI)
如果这个错误是在某个已经存在很久的 Agent/Coding 会话中突然出现的,建议:
直接新建一个 conversation/session 测试。
因为 Function Calling 的历史 item 已经可能和当前 call_id / item_reference 对不上。
类似问题在一些基于 OpenAI Responses API 的第三方客户端中也出现过,常见处理方式就是升级客户端后重新建立新会话,不要继续复用损坏的历史状态。(LINUX DO)
| 你的场景 | 建议 |
|---|---|
| 普通 Grok 对话 | 不要用 previous_response_id |
| 单次 Function Calling | HTTP + 完整 input history |
| 多轮 Function Calling | WebSocket v2 |
| Coding Agent | WebSocket v2 |
| MCP Agent | WebSocket v2 |
| OpenAI SDK → xAI | 检查 Responses API 的续接实现 |
| 已经报错的旧会话 | 新建 session |
如果你把你现在调用 Grok 的那段代码贴出来(尤其是 responses.create() / function_call_output 那部分),我可以直接帮你定位是哪一行导致这个 400,并给你改成可以直接运行的 xAI Grok Function Calling 版本。
```
原文作者根据Artificial Analysis 的数据绘制
横轴价格,纵轴模型得分,新版DeepSeek-v4-flash守门员无情绝杀
过去一周,我用AI扫描了浑水调研(62,342篇)、商业航天投行KB(2,187篇)、黑猫知识库三个投研知识库的最新上传内容,识别出12条新兴投资叙事。然后花了两天时间,用公开网络信息对其中最核心的7条做了交叉验证。
这是本周最重磅的信号。7月23日凌晨,谷歌母公司Alphabet发布2026年Q2财报。数据极其炸裂:
但最重要的数字是Capex:
全年资本开支指引从1800-1900亿美元上调至1950-2050亿美元,上调约150亿美元。
此前市场有传言”谷歌砍Capex”——完全被证伪。
更值得关注的是三个细节:
第一,自由现金流首次转负。 谷歌Q2自由现金流为-58.6亿美元,上市以来第一次。但这并非坏事——负值主要来自存货和应收账款大增,意味着谷歌正在疯狂备货外售硬件(TPU首次对外交付)、扩大云业务规模。
第二,管理层明确表态。 “算力供给长期跟不上需求,只要投资回报具备吸引力,会持续加码未来两年AI基建。”这不是含糊的”我们会继续投资”,而是明确的”我们会继续加码”。
第三,大行形成罕见一致共识。 摩根士丹利、野村、伯恩斯坦在24小时内密集发布解读,形成”一致看多”信号:
摩根士丹利(7/23):预测2026年超大规模云厂商AI总资本开支约8700亿美元,”风险偏向上行”。其研究部认为数据中心建设面临的政治阻力是供给侧风险而非需求侧风险——阻力只会拉大供需缺口,而非降低投资意愿。同时,信用部门测算2026年AI相关债务融资约5000亿美元,约为去年的两倍。
野村(7/24):预测AI服务器收入2026/2027年分别增长78%/76%,上调台积电、日月光、联发科等9家亚洲AI科技公司目标价。特别指出neocloud(新兴云厂商)在GB300周期后半段capex更加激进——这不是CSP的”接力”,而是”叠加”。
伯恩斯坦(7/23):谷歌Q2点评标题”Is It Time to Eat or Sleep?”——暗示犹豫就是错失机会。
但大摩内部并不完全一致。 其首席美股策略师Mike Wilson明确提出:当前更偏好超大规模企业(微软、亚马逊、Meta)而非半导体股,理由是AI交易内部已出现结构性裂缝——但这不是见顶信号,而是轮动机会。
验证结论:知识库中的A1叙事被全面验证且程度更强。谷歌云收入增速(82%)和capex上调幅度(150亿美元)均超出知识库简介的描述。大摩内部的分歧也提供了更丰富的决策维度。
如果说谷歌财报是”AI需求”的验证,那么Q2公募基金季报就是”AI定价”的验证。
申万宏源和广发基金在7月23日同一天发布分析,标题分别为《资金K型分化,科技持仓突破60%》和《一份”前所未有”的基金季报》。
华创证券的数据更为具体:
有必要做一个对比:
| 时期 | 抱团板块 | 持仓峰值 |
|---|---|---|
| 2020年初 | 食品饮料+医药 | ~35% |
| 2022年 | 新能源 | ~40% |
| 2026年Q2 | 电子+通信 | ~60% |
“前所未有”不是修辞,是统计事实。
但这不是单边看多的信号。 广发证券明确指出——“630的数据,到7月市场已经发生了很多变化”。7月以来科技板块大幅回调,创业板指年内收益已从36.4%收窄至7.5%。60%的集中度既是AI趋势的终极验证,也是拥挤度的最高警报。
验证结论:A2叙事被全面验证。申万宏源、广发、华创三家独立来源交叉确认。60%的数字在市场广泛传播,已成为本周最重要的机构行为信号。
7月是CCL(覆铜板)行业的”涨价月”:
花旗在7月22日同一天发布两份报告——基于南亚新材和建滔积层板的电话会。核心信号只有一句话:下游客户开始接受涨价。
这不是一个普通的涨价故事。关键在原因:
常规思维会认为涨价由原材料成本推动。但这一轮的核心驱动力是产能的结构性错配:
上游供给端同样无解:
更值得关注的是业绩兑现。宝鼎科技(子公司金宝电子做CCL和铜箔)上半年净利预增468%-560%,南亚新材拟7.9亿投建高端CCL扩产项目。涨价正在从”预期”变成”利润”。
验证结论:B3叙事被全面验证且链条更加丰富。花旗确认下游接受的信号、建滔第六轮涨价、电子布年内最大单月涨幅——三条信息相互印证,AI通胀传导已形成”上游材料紧缺→CCL涨价→下游接受→利润兑现”的完整闭环。
固体氧化物燃料电池(SOFC)作为AI数据中心供电方案,已从”概念”进入”订单爆发”阶段。
核心信号来自多个维度:
政策端:2026年6月18日,美国FERC(联邦能源监管委员会)要求六大电网运营商修改大负荷电网接入规则,加速数据中心并网,并要求30天内提交资源充足性报告。这是监管层面的明确加速信号。
产业端:Bloom Energy是SOFC全球龙头,其订单数据说明一切:
研究端:东方证券、华源证券、国信证券、西部证券四家机构在6-7月密集发布SOFC深度报告。国信预测2030年数据中心SOFC新增装机16GW,市场规模超415亿美元,2025-2030年CAGR约94%。
为什么SOFC突然加速?
核心矛盾是算力建设与电网扩容的期限错配:
当燃气轮机和发电机都排不上队时,SOFC”50MW 90天、100MW 120天”的极速交付优势就从”锦上添花”变成了”雪中送炭”。
摩根士丹利也直接点名了SOFC。 在其7月23日关于数据中心政治阻力的报告中,大摩明确写道:”燃料电-池、燃气轮机和储能正在变得越来越重要,因为运营商寻找减少对漫长电网互联流程依赖的方式。”
验证结论:B4叙事被全面验证且程度超出预期。东方证券5月的”奇点将至”判断,在7月得到Bloom Energy超200亿在手订单+FERC政策加速+大摩点名三重确认。”奇点”不是一个预测,而是一个正在发生的事实。
铜的叙事版本正在被重写。
2026年初,市场的主流叙事是”铜矿供给增加+中国地产疲软→铜价承压”。但7月的数据彻底推翻了这个框架:
供给端连续出问题:
库存端持续告急:
需求端出现新变量:
中信证券在7月24日研报中给出更激进的预测:中性假设下,年内LME铜价有望冲击15000美元/吨(当前约14000美元)。
这不仅是周期反弹,而是供需基本面的结构性重估。 从”供给过剩→价格承压”到”供给零增长+库存极低→价格向上弹性巨大”,范式正在被修正。
验证结论:B5叙事被全面验证。铜矿增量下修至26万吨(知识库提及”下修至零”略有夸大,ICSG数据为26万吨)、库存十年低位、中信/中金/高盛三家中外机构独立确认。但需注意:ICSG在4月将全球精炼铜市场从”短缺15万吨”修正为”小幅过剩9.6万吨”,再生铜是重要变量。
本周创投圈传播最广的材料,是梁文锋(DeepSeek创始人)5月20日与投资人的闭门交流实录。
这份实录长达42页、118组问答、近4小时。7月23日意外流出后,立刻成为创投圈的”必读文本”。
凤凰网《AI研究院》和投中网分别做了深度解读。核心信号有几条:
1. “克制是一种战略”
梁文锋开篇就”劝退”投资人:”我们并不会有这样的想法,说我要做成下一个超级App,要去跟谁竞争,做成下一个字节、下一个腾讯,完全没有。””如果想把AI这个事情做成,首先第一个是需要克制的,不能够想着人类GDP的百分之多少都归我了。”
2. API定价:十个月收回成本即可
DeepSeek在4月25日将旗舰模型V4-Pro的API价格永久降至原价的四分之一,输入低至每百万Tokens 0.025元。梁文锋透露:一开始因为担心需求太多把价格定高了,”团队里大家不是很高兴”,后来降到四分之一,”公司群里面很多人是欢呼的”。
3. 估值与融资
4. 与OpenAI/Anthropic形成鲜明对比
当OpenAI拟秘密提交IPO文件(目标最早9月上市)、Anthropic有望Q2首次盈利时,DeepSeek创始人却说”AGI才是大西瓜”、”最强模型也会开源”。这种”非商业化”哲学,在中国互联网三十年的抢滩历史中,前所未有。
验证结论:B6叙事被全面验证。凤凰网、投中网、彭博社、网易智能、搜狐科技五家独立媒体交叉确认。但A股映射链条仍不直接——DeepSeek尚未上市,国产算力链的传导需要进一步验证。
几乎在叙事扫描完成的同时,Anthropic于7月24日发布了Claude Opus 5。这是本周最及时的产业验证。
在57天内,Anthropic完成了对Claude全产品线的更新:Opus 4.8(5/28)→ Fable 5 + Mythos 5(6/9)→ Sonnet 5(6/30)→ Opus 5(7/24)。
Opus 5的核心突破不是”更强”,而是”更自主”:
自主解决问题的能力跃升:
性价比大幅提升:
但这背后是一个更深层的叙事变化:
知识库中提到的”Token消耗受可靠性限制”框架正在被改写。Opus 5展示的”自我验证、反复迭代直到成功”的能力,意味着模型越强,能自主完成的任务越复杂,Token消耗越大,但单位任务的可靠性也在同步提升——Token经济不再是简单的”量”的问题,而是”质”的问题。
验证结论:B7叙事被全面验证且比知识库内容更进一步。知识库讨论的是Opus 5/GPT-6的预期,而Opus 5已经在7月24日发布了——Agent自主性的提升不是”未来时”而是”现在时”。ARC-AGI3得分是第二名3倍的数据尤其值得关注(模型解决全新问题的能力)。
| 时间 | 事件 | 对应叙事 |
|---|---|---|
| 7/28-8/1 | 微软/亚马逊/Meta Q2财报 | ①AI capex趋势能否跨公司验证 |
| 8月 | 英伟达Q2财报+Rubin爬坡指引 | ①算力需求定价 |
| 8月 | CCL下一轮报价 | ③涨价持续性 |
| 8月 | Q3公募基金申赎数据 | ②科技赎回压力 |
| 8月 | Opus 5实际使用反馈 | ⑦Agent能力边界 |
| Q3 | SOFC实际订单落地(Bloom Energy Q2) | ④奇点验证 |
| Q4 | 国产AI芯片950大规模出货 | ①国产算力兑现 |
| 年内 | DeepSeek科创板IPO申报 | ⑥国产AI生态 |
本周的交叉验证指向一个清晰的结论:“AI不会减速”正在从市场猜想变为跨源共识。
谷歌的capex上调、大摩/野村的一致看多、公募基金60%的科技持仓、CCL从”涨价”到”下游接受”的传导闭环、SOFC从”概念”到”200亿在手订单”的跨越、铜从”过剩”到”紧缺”的范式修正——这六条叙事相互独立但逻辑自洽,共同构建了一个”AI需求→电力需求→材料需求→产能紧缺→涨价传导→利润兑现”的完整产业链叙事链。
而梁文锋的”克制”和Opus 5的”自主”则从AI生态的角度提供了另一个观察窗口:商业化不是唯一的路径,Agent能力正在重新定义”Token经济”的边界。
但必须提醒:验证叙事不等于确认交易机会。 Q2公募科技持仓60%既是趋势验证也是拥挤警报,大摩内部的”多头vs策略”分歧也在提醒:共识越强,反转的代价越大。
接下来的两周是关键——微软、亚马逊、Meta的Q2财报将验证谷歌的信号是”个例”还是”趋势”。如果三家都交出类似答卷,那么”AI不会减速”将从”叙事”变成”事实”。
本文基于浑水调研、商业航天投行KB、黑猫知识库的投研内容,结合公开网络信息交叉验证。数据截止2026年7月26日。不构成投资建议。
第一轮面试官(技术负责人)
第二轮面试官(同事/交叉面)
排查召回效果应建立“检索漏斗 + 人工标注”的闭环:
微软将TypeScript编译器移植到Go,实现了10倍性能提升,并深入探讨了Go在智能体开发时代的优势及其对技术栈的影响。
本文记录了在 Fish Shell 中使用 vfox use -p 命令时出现 Warning: The current shell lacks hook support or configuration 警告的原因及解决方法。
账户类型不同,操作略有差异,但核心要素一致:配债代码(公告公布,通常7或8开头)、价格(100元/张)、数量(系统显示的可配售张数)。
选择菜单:进入交易软件,点击“卖出”菜单。部分券商设有专门的”配债”入口,如有可直接使用。
配债本质是用”配股权”换债券,系统将其识别为卖出权利,因此要用”卖出”。误选”买入”一般会被拒绝。
输入配债代码:务必输入配债代码,不要输成正股代码或申购代码。
输入价格:填 100。
输入数量:填入系统显示的可配售张数。
确认下单:资金冻结即表示缴款成功。
1 | [三位一体·叙事空间创作系统 v3.0] |
不要在官方网页尝试,有二次拦截一般无法突破限制,甚至可能导致账号封禁(用官方的网页,官方会审核ai输出的内容),需使用第三方对话应用(如自行部署NextChat,或安装Cherry Studio客户端)接入DeepSeek大模型对话,我使用硅基流动的deepseek-ai/DeepSeek-V4-Pro模型测试有效
1 | <特殊模式> |
推荐使用 硅基流动,注册免费获取价值14元token,需实名认证后使用