文章归档

浏览 ZiCode 的技术文章、专栏与随笔,内容按时间倒序整理,覆盖编程、AI 工具、本地模型和工程实践。

Agent 做出来了,接下来怎么上线
原创 人工智能 · 工程实践 · 阅读

Agent 做出来了,接下来怎么上线

一个能完成任务的 Agent,距离真正可交付还差任务契约、交互兜底、质量门禁、安全审查、成本核算和灰度运营。本文以合同审查 Agent 为例,给出一套可以直接执行的产品化方法。

把 Pi 做成 Windows 应用:Electron 还是 Tauri?
原创 AI 工程 · 阅读

把 Pi 做成 Windows 应用:Electron 还是 Tauri?

评估把 Pi Coding Agent 封装成 Windows 独立应用的两条路线:Electron 直接嵌入 Pi SDK,以及 Tauri 搭配 RPC Sidecar。重点讨论是否需要预装 Pi、Node 与 Bash 如何打包、进程边界、安全控制和实际选型。

Agent 找到工具以后,为什么还是会用错
原创 人工智能 · 工程实践 · 阅读

Agent 找到工具以后,为什么还是会用错

正确工具进入候选列表,只解决了工具调用链的第一小步。本文拆解召回、选择、参数、执行和结果解释五道门,用实际案例说明怎样设计工具契约、参数修复、候选裁剪和分层评测。

GPT-5.6 Sol 的额度去哪了
原创 人工智能 · 工程实践 · 阅读

GPT-5.6 Sol 的额度去哪了

为什么同样的任务,GPT-5.6 Sol 会让人觉得额度掉得更快?从工具调用、缓存输入、长上下文、重试和子任务拆开一次 Agent 回合,给出一套可以自己复测的用量账本。

llms.txt:给 Agent 的网站说明书
原创 AI 工程 · 阅读

llms.txt:给 Agent 的网站说明书

llms.txt 到底是什么,和 robots.txt、sitemap、OpenAPI 有什么区别?本文结合 OpenAI、Anthropic、Cloudflare、Supabase、Vercel、Stripe 与 FastHTML 的公开文件,拆解格式、分层、生成、校验和上线后的最佳实践。

怎样让 Codex 真正会用你的工具
原创 人工智能 · 工程实践 · 阅读

怎样让 Codex 真正会用你的工具

给 Codex 接上 MCP 只是第一步。本文实现一个代码变更影响分析工具,用 36 次真实调用比较含糊接口与语义化 Schema,拆解工具命名、参数设计、结构化输出、安全注解、错误语义和评测方法。

企业级 Agent 的七层底座
原创 人工智能 · 工程实践 · 阅读

企业级 Agent 的七层底座

一个能接入真实业务的 Agent,除了模型和 Prompt,还需要任务契约、可恢复运行时、工具协议、状态与记忆、并发控制、安全边界和评测体系。本文用三个案例给出一套可落地的参考架构。

在 WSL 里把 Vulkan 跑起来
原创 图形编程 · 工程实践 · 阅读

在 WSL 里把 Vulkan 跑起来

一套经过实际验证的 WSL Vulkan 学习环境:弄清 Dzn 与 Lavapipe 两条执行路径,安装工具链,枚举物理设备,编译 Shader,并建立从第一个三角形到调试、同步和小型渲染器的学习路线。

VPN 开着时 WSL 冷启动断网,我最后换成了 VirtioProxy
原创 开发环境 · 阅读

VPN 开着时 WSL 冷启动断网,我最后换成了 VirtioProxy

一次真实的 WSL 网络故障复盘:Mirrored 模式在特定 Windows 网络环境下冷启动失败,Linux 只剩回环接口。记录如何区分接口、路由和 DNS 问题,切换 VirtioProxy,并用多轮冷启动验证结果。

一周写了 186 GB:WSLg 的 RdClientAutoTrace 撑满了 C 盘
原创 开发环境 · 阅读

一周写了 186 GB:WSLg 的 RdClientAutoTrace 撑满了 C 盘

一次 Windows 11 磁盘空间异常复盘:从 C 盘只剩 69.5 GB 开始,逐层定位到 WSLg 远程桌面组件持续生成 ETL 日志,安全清理后保留 WSL、WSLg 与 Docker Desktop,并建立复发监控。

Agent面试详解(下):评测、安全与落地判断
原创 人工智能 · 工程实践 · 阅读

Agent面试详解(下):评测、安全与落地判断

完成企业级 Agent 的最后一块设计:用 Trace 还原轨迹,用四层测试控制不确定性,把安全边界放在模型之外,并判断 ToB、ToC 与具体场景是否值得投入。

让 Codex 连续干几天,靠的不是一条超长 Prompt
原创 人工智能 · 工程实践 · 阅读

让 Codex 连续干几天,靠的不是一条超长 Prompt

以一套虚构统一授权系统从设计、开发到测试跑通的完整演练为主线,拆解 Codex 如何借助 Goal、状态外置、检查点、模型档位切换和分层验收完成长任务。

用 Codex Sites 搭一个能调用 QVeris 的天气网站
原创 人工智能 · 工程实践 · 阅读

用 Codex Sites 搭一个能调用 QVeris 的天气网站

从一份完整 Prompt 出发,用 Codex Sites 生成城市气象观察站,并设计 QVeris 动态工具发现、服务端调用、统一数据模型和凭证保护链路。文中包含在线地址、真实页面截图、访问限制和后续接入方案。

给 Web、CLI 和远程服务器做一套统一授权
原创 工程实践 · 阅读

给 Web、CLI 和远程服务器做一套统一授权

用一个可复制的示例,从协议选择、数据模型和接口契约开始,实现同时服务 Web、桌面 CLI、WSL、远程服务器与 API 的 OAuth 2.0/OIDC 统一授权系统。

GPT-5.6 试用了半天:强,但真的慢
原创 人工智能 · 阅读

GPT-5.6 试用了半天:强,但真的慢

我用 Codex 实测 GPT-5.6 Sol、Terra、Luna,并对 Sol 的 low、medium、high、xhigh 四档做了同题测试。本文记录真实耗时、token、API 等价成本,以及 Sites 插件当前能走到哪一步。