AI Agent
架构、工具调用、Memory、RAG、评测、权限与运行时治理。
从具体问题出发,找到能验证、能复现的答案。
XBSTACK 是小白长期维护的个人知识与产品系统,持续更新 AI Agent、MCP、LangGraph、Workflow 的工程实践,也提供开发者工具、投资复盘和户外现场记录。
⌕ 搜索报错、技术问题、工具、主题或文章…架构、工具调用、Memory、RAG、评测、权限与运行时治理。
Server、Transport、OAuth、权限、安全与协议排障。
状态、Checkpoint、HITL、失败恢复、并发与可观测性。
n8n、自托管、Webhook、队列、重试、幂等与成本治理。

OpenAI 在 2026 年 9 月推出 Agents API 后,Responses API、Agents SDK、Agents API 三套能力很容易被混在一起。本文从 Agent Loop、状态、恢复、Tool Calling、Sandbox、多 Agent、成本、可移植性和业务控制权拆解三者的真实边界,并给出生产选型路径。

Google ADK 调用 delete_session() 后,为什么 add_session_to_memory() 写入的长期记忆仍能被 search_memory() 搜到?本文用 2.8.0 与 2.9.0 做离线最小复现,并说明删除边界和生产处理方式。

Codex CLI 收到 SSE response.failed 后为什么还会等待,最终只显示 idle timeout waiting for SSE?XBSTACK 在 0.153.4 与当前稳定版 0.154.0 上独立复现,给出最小 loopback fixture、版本矩阵、诊断边界与临时处理建议。

LangGraph conditional router 抛异常后,invoke(None, config) 为什么看似恢复成功却不再执行 router 和下游节点?本文在 langgraph 1.2.11 上用 InMemorySaver 与 SqliteSaver 独立复现,并验证把可失败路由逻辑移入普通 node 的临时方案。

OpenAI CFO Sarah Friar 表示,公司正在企业 AI 中试验基于业务结果而非单纯使用量的定价。本文结合 OpenAI、Intercom、Salesforce、AWS 等一手资料,分析 AI Agent 定价为何从 Token/Usage 走向 Task、Outcome 与 ROI,以及独立开发者应如何设计成本、评测、计费和模型路由。

Hugging Face Funes 本地实测:5 个已知目标查询 Hit@1/Hit@5 均为 100%,平均 recall 约 3.14 秒;同时验证无关查询仍返回低分候选、过时记忆仍可能被召回,以及 Codex trace 索引、secret scrub 和本地运行边界。