Harness Pipeline:给 AI 编程套一条带护栏的跑道

Posted on 四 21 5月 2026 in Tech • Tagged with ai-coding, pipeline, sdd, tdd, bdd, mdd, ddd, openspec, methodology

传统 Build Pipeline 是为"人写代码、机器构建"设计的;AI 编程时代需要一条新流水线——SDD(OpenSpec + DDD)→ TDD → BDD → MDD,配上静态分析、AI Review、规则检查,把"AI 生成"变成"AI 可交付"。


Continue reading

从 PDF Skill 学到什么:把 AI 能力做成可执行流程

Posted on 三 20 5月 2026 in Tech • Tagged with AI, Skills, PDF, Agent Engineering, Automation

一个好的 AI Skill 不只是提示词,而是一套可触发、可分流、可执行、可验证的工作流。本文以 Anthropic 的 PDF skill 为例,拆解它的设计亮点,也指出它在 PDF-to-Markdown 解析上的关键缺口。


Continue reading

从纯文本生成 docx/pdf:难点从来不在“转换”两个字

Posted on 日 17 5月 2026 in Tech • Tagged with Plain Text, Markdown, AsciiDoc, reStructuredText, LaTeX, Typst, docx, PDF, Pandoc, Web Editor, Document Engineering, JSON Resume

从 Markdown、AsciiDoc、reStructuredText、LaTeX、Typst 到结构化 JSON,纯文本生成 docx/pdf 看起来只是格式转换,真正麻烦的是源格式选型、样式契约、版式一致性、Web 在线编辑、安全沙箱和多人协作。


Continue reading

Vibe Coding 时代:起码要知道 AI 在做什么

Posted on 六 16 5月 2026 in Tech • Tagged with AI, Vibe Coding, AI Coding, Software Engineering, Harness Engineering

Vibe Coding 可以把编码速度拉满,但开发者不能把判断力也交出去。真正值得练的能力,是从逐行写代码升级为制定规则、绘制蓝图、技术把关和产品监控。


Continue reading

如何做一个接近零停机的 HTTP 服务

Posted on 五 08 5月 2026 in Tech • Tagged with zero-downtime, high-availability, active-active, retry, idempotency, sre, architecture

零停机服务不是一句“部署两套集群”就能实现的口号。真正可用的方案,是 active-active 流量、快速超时、跨集群重试、熔断摘除、共享幂等状态和无状态应用设计一起配合,让一次集群故障尽量止步于一次请求内部。


Continue reading

从 1:1 Chat 到群聊:让人和多个 AI Agent 一起开会

Posted on 四 30 4月 2026 in Tech • Tagged with AI Agent, Multi-Agent, Group Chat, Conversation Architecture, Human-in-the-loop, LLM

1:1 AI Chat 像请了一个聪明顾问,群聊式 Multi-Agent 则像把产品、架构、安全、测试和人类决策者拉到同一张桌子上。本文讨论如何从单 Agent 对话演进到多人多 Agent 群聊:消息模型、路由策略、Agent 互相对话、上下文隔离、权限治理和最小可用实现。


Continue reading

用开源组件搭一个 AWS IAM 风格的授权系统

Posted on 三 29 4月 2026 in Tech • Tagged with authorization, IAM, OPA, OpenFGA, Keycloak, STS, SPIFFE, SPIRE, RBAC, ABAC, ReBAC, security

如果要用开源组件搭一个 AWS IAM 风格的授权系统,不能只靠 OpenFGA 或 OPA。更合理的组合是 Keycloak/Dex 做用户身份,SPIFFE/SPIRE 做工作负载身份,STS 服务签发短期角色会话,OpenFGA 表达 trust/resource relationship,OPA 表达 permission policy、condition 和 explicit deny,再由 API Gateway 或服务中间件作为 PEP 执行决策。


Continue reading

Agent Box 初探:从 OpenClaw 小龙虾安全问题谈 Agent Sandbox

Posted on 三 29 4月 2026 in Tech • Tagged with AI Agent, Agent Sandbox, OpenClaw, Kubernetes, Sandbox, gVisor, Kata Containers, Security, RBAC, NetworkPolicy

AI Agent 一旦从“会聊天”走向“会动手”,最大的问题就不再是模型够不够聪明,而是它在哪里动手、能碰什么、出错后谁来收拾。本文结合 OpenClaw 小龙虾近期暴露的 prompt injection、token/credential 暴露、工具权限和本地网关风险,聊聊为什么 Agent 需要一个隔离、持久、可编程的 Sandbox,以及如何用 Sandbox CRD、Template、Claim、WarmPool、KSA/RBAC 和 NetworkPolicy 搭出第一版。


Continue reading

用 Podman 替代 Docker:从迁移到跑通 docker-compose

Posted on 一 27 4月 2026 in Tech • Tagged with podman, docker, container, docker-compose, devops

Docker Desktop 收费了,License 审计来了,你的 CI 环境又不想装 Docker daemon。Podman 是个不错的替代品——无守护进程、兼容 Docker CLI、还能跑 docker-compose。这篇文章从一个老程序员的迁移经历出发,讲清楚怎么切换,以及用一个 Python Web App + MySQL 的 compose 例子把路趟通。


Continue reading

给 secrets 表加 history 表:这是不是一个靠谱的审计方案?

Posted on 一 27 4月 2026 in Tech • Tagged with mysql, audit-log, database, secret-management, partitioning, reliability

用 secrets_action_history 记录 secrets 表的新增、修改和删除,看起来像一个小需求,其实踩中了变更索引、审计、备份、review、性能、数据生命周期和 MySQL 分区限制这几块地雷。本文讨论这个方案是否靠谱,并给出按时间窗口拉取变更、定时清理、分区维护和巡检的落地方案。


Continue reading

ChaosBlade:把混沌工程从口号变成可回滚的实验

Posted on 一 27 4月 2026 in Tech • Tagged with chaos-engineering, chaosblade, reliability, sre, kubernetes

ChaosBlade 是阿里巴巴开源的混沌工程实验工具。它的价值不在于“搞坏系统”,而在于用可控、可观测、可回滚的实验,提前暴露分布式系统里的脆弱假设。


Continue reading

Hermes Agent 初探:一个会长记性的个人 Agent,以及它和 OpenClaw 的比较

Posted on 六 25 4月 2026 in Tech • Tagged with AI Agent, Hermes Agent, OpenClaw, Feishu, OpenAI API, DeepSeek, OPC

Hermes Agent 有趣的地方,不只是能聊天、能跑工具,而是把 memory、skills、gateway、scheduler 和 provider routing 放进一个长期运行的个人 agent。这篇文章基于 2026-04-25 查阅的官方资料,聊聊 Hermes Agent 的定位、它和 OpenClaw 的比较,以及接入 Feishu/Lark、DeepSeek 与 OpenAI-compatible API 的实践清单。


Continue reading

如何把你的论文发布到 arXiv

Posted on 六 25 4月 2026 in Tech • Tagged with arxiv, research, paper, thesis, open access

介绍 arXiv 是什么, 适合发布什么类型的论文, 以及从准备稿件到提交、背书、授权和公告的完整流程。


Continue reading

安全混沌工程:把安全事故演练成消防演习

Posted on 五 24 4月 2026 in Tech • Tagged with security, chaos-engineering, incident-response, resilience, tabletop-exercise, game-day

混沌工程不该只服务于稳定性。面对密码泄漏、账号被盗、数据外泄、勒索加密等安全事故,团队也需要像消防演习一样,在平时用可控、低风险的方式反复演练发现、响应、隔离、恢复和复盘。


Continue reading

从 Cursor 迁到 Codex:别急着抄配置,先把脑回路迁过去

Posted on 四 23 4月 2026 in Tech • Tagged with Cursor, Codex, AGENTS.md, hooks, AI coding, workflow

很多人以为从 Cursor 迁到 Codex 只是把 .cursor/ 改成 .codex/,结果第一天就撞墙。真正难迁的不是目录,而是概念:Rules、Commands、AGENTS、Skills、Hooks、Sandbox、Approval 在两边的含义并不一样。结合官方文档和我在博客仓库里的真实迁移痕迹,聊聊怎么迁、先迁什么、哪些坑最容易踩。


Continue reading

AI 时代,别只囤笔记:我是怎么把知识库做成一部活的 Wiki

Posted on 三 22 4月 2026 in Tech • Tagged with AI, knowledge-base, wiki, PKM, RAG

AI 很强,但它并不了解你的项目、你的经历和你的判断。真正有用的知识库,不是把笔记堆起来,而是把原始材料、结构化页面、治理规则、来源与校验串成一条流水线。结合我最近折腾的一套私人原型,聊聊我是怎么搭自己的知识库,以及怎样让它不只是一个"仓库"。


Continue reading

Axios 被投毒:一场教科书级的供应链攻击复盘

Posted on 三 01 4月 2026 in Tech • Tagged with security, supply-chain, npm, axios, RAT, dependency-management

2026 年 3 月 31 日,周下载量过亿的 npm 包 axios 被投毒,两小时内所有 npm install 的机器可能已沦陷。这次事件再次说明:你写的代码也许没有 bug,但你装的依赖里可能藏着一扇后门。


Continue reading

从 Prompt Engineering 到 Harness Engineering:AI 编程的四次进化

Posted on 六 28 3月 2026 in Tech • Tagged with harness-engineering, AI, prompt-engineering, context-engineering, Tauri, Rust, Claude Code

OpenAI 用 Codex 在五个月内生成了百万行代码,零行手写。背后的方法论叫 Harness Engineering——不是教 AI 怎么写代码,而是给 AI 搭一个"跑不偏"的环境。本文梳理从 Prompt Engineering 到 Harness Engineering 的四次进化,并用一个实战案例演示:一个不会 Rust 的老程序员,如何靠 Harness Engineering 用 Tauri 写出一个桌面 Todo 应用。


Continue reading

从 LiteLLM 供应链投毒事件聊聊密钥安全

Posted on 六 28 3月 2026 in Tech • Tagged with security, supply-chain, python, secrets-management, LiteLLM

2026年3月,LiteLLM 遭遇供应链投毒,恶意包窃取用户密钥和云凭证。本文从 .pth 文件机制、漏洞根因、密钥不落盘理念到业界通用方案,聊聊 AI 时代的密钥安全。


Continue reading

从 RAG 到 GraphRAG:当检索增强生成遇上知识图谱

Posted on 四 26 3月 2026 in tech • Tagged with graphrag, rag, knowledge-graph, llm, ai, leiden, community-detection

传统 RAG 在处理复杂多跳问题时力不从心,GraphRAG 通过引入知识图谱为检索增强生成带来了结构化推理能力。本文从痛点分析、核心架构、Leiden 社区检测算法到工程实践,全面深入剖析 GraphRAG。


Continue reading