集群

智能体工程

编程智能体、MCP、上下文系统、评估与可靠自动化控制。

博客文章
80
主题
AI 与智能体

从核心文章开始

只收重要内容

获取下一篇关于AI 与智能体的一线笔记

有新文章时发送一封简短邮件,不使用跟踪像素,也不发送填充内容。

本集合最新内容

Wavect 的 Google AX 文章封面,以盾牌表示智能体执行的控制边界 AI 与智能体

Google AX Agent Executor:预算、沙箱与自托管

沙箱不等于账单上限。弄清 Google AX 控制了什么、恢复时保留哪些状态,以及想掌握自己的 AI 时必须核查哪些依赖。

原始智能体轨迹被整理为持久 Wiki,并生成通过验证的 SKILL.md 文件 AI 与智能体

WikiSkill:智能体如何从经验中进化 SKILL.md

WikiSkill 把智能体轨迹编译为持久证据 Wiki,再验证对 SKILL.md 的原子修改。本文评估基准结果、跨模型迁移、研究限制与生产试点架构。

Octop 在同一应用栈中连接用户、AI 智能体、工具与自托管数据 AI 与智能体

腾讯 Octop 评测:开发者真正免费获得了什么

腾讯以 MIT 许可证发布 Octop,包含多用户智能体、控制台、自动化与存储。本文核查实际范围、外部依赖、生产成本和安全责任。

Wigolo 将一个 AI Agent 查询分发到多个搜索引擎,在本地重排证据,并通过 MCP 提供十种 Web 工具 AI 与智能体

Wigolo 评测:AI Agent 的本地优先 Web Intelligence

Wigolo 无需付费搜索 API,就能为 AI Agent 提供本地优先的搜索、抓取、提取与研究。本文核查十种工具、缓存、隐私、AGPL 与生产边界。

Wavect 编辑插画中的多层上下文卡片,象征 AI 智能体的持久记忆 AI 与智能体

Supermemory:AI 智能体记忆、RAG 与本地部署指南

无需自行搭建完整记忆管道,为 AI 智能体增加跨会话上下文。通过 API 示例、本地配置与基准分析,判断 Supermemory 是否适合你的产品。

Wavect 原创盾牌主题封面,象征具有明确边界的 AI 智能体设计模式 AI 与智能体

AI 智能体设计模式:从简单开始,执行前验证

循环越多,不代表系统越好。选择能解决具体故障的最小智能体架构,并将动作建议与执行权限分开。

完整文章目录

  1. Google AX Agent Executor:预算、沙箱与自托管
  2. WikiSkill:智能体如何从经验中进化 SKILL.md
  3. 腾讯 Octop 评测:开发者真正免费获得了什么
  4. Wigolo 评测:AI Agent 的本地优先 Web Intelligence
  5. Supermemory:AI 智能体记忆、RAG 与本地部署指南
  6. AI 智能体设计模式:从简单开始,执行前验证
  7. Claude Mods:配置、Function Hooks 与安全指南
  8. Voicebox:本地声音克隆、语音输入与 MCP 配置
  9. Valyu 的 0.6B 多智能体路由器:研究结果、指标边界与落地判断
  10. OpenAI Agents API 评测:迁移、成本与数据控制
  11. Spotify shunt 评测:安装、Token 节省与限制
  12. OpenBot 评测:自托管 AI 同事的成本与权限
  13. Ramp Inspect 架构 2026:如何扩展后台编码 Agent
  14. Model Hardware Standard 企业指南:MHS 与实体 AI
  15. Fonio AI 2026 评估:价格、API、GDPR 与自建对比
  16. Mosaic(YC S26)评测:团队编码 Agent 的共享记忆
  17. Ripwire 评测 2026:无需 Embedding 的 AI 仓库上下文
  18. AI 编程智能体的多文件原子修改:Semaprax 开发教训
  19. AI 智能体知识迁移:前沿模型探索一次,低成本模型规模执行
  20. claude-rotate:一个代理管理多个 Claude Max 账户
  21. Feynman 评测:这款开源 AI 研究 Agent 适合团队吗?
  22. Obscura 浏览器评测:性能主张、限制与生产适用性
  23. Claude Code 设计系统:用 4 个部分保持品牌一致
  24. ChatGPT 能登录网站,而且模型看不到密码
  25. AI 智能体 Harness 图解:LLM 周围的可靠性层
  26. 智能体编辑为何需要语义身份:用 Rust 构建 SEMAPRAX
  27. LangChain Deep Agents 评测:Agent Harness 能否用于生产?
  28. OpenViking 评测:面向 AI 智能体的文件系统式记忆
  29. LLM-as-a-Verifier 详解:架构、成本与生产适用性
  30. TrueForge 评测:开源 Agent Harness 是否达到生产要求?
  31. 智能体可读的网站:llms.txt、Markdown 镜像,以及会坏在哪里
  32. 本地化 URL slug 与 hreflang:为什么我们保留一个英文 slug
  33. AI 智能体能用你的产品,还是只能读到它?
  34. Graft 评测 2026:智能体仓库地图该进 Git 吗?
  35. 通过工具输出压缩降低编码代理成本
  36. 用 AI 编码智能体更聪明地管理 Token
  37. DeepSeek Harness 评测:插件化 Agent 技术栈能否用于生产?
  38. OpenSandbox 评测:自托管是否值得?
  39. Cloudflare Kitesurf 评测:成本、限制与生产适用性
  40. GitHub Spec Kit 评测:这套流程值得吗?
  41. 企业内部 AI 智能体市场:2026 架构与落地指南
  42. Linux 是 AI 智能体的最佳操作系统吗?2026 基础设施指南
  43. MCP Cloud 对比 Manufact Cloud:MCP 托管指南
  44. 如何用 Agent Skills 让 AI 写作更自然
  45. NVIDIA NOOA 评测:面向对象智能体适合生产环境吗?
  46. Strix AI 渗透测试:2026 年 30 天试点与采购指南
  47. Hyperagent 评测:无需自建服务器的云端 AI 智能体
  48. Hark Handoff 评测:真正会点击网页的智能体
  49. Meta Muse Code 定价:Contributor 能用于客户代码吗?
  50. LLM 提示词发送前的 PII 脱敏:实用流水线
  51. Agent Reach 评测:真实成本、安全边界与生产适用性
  52. Cloudflare Wallets AI 智能体钱包:哪些功能已上线?
  53. YC QM Agent 评测:Quartermaster 能用于工作吗?
  54. jcode 对比 Claude Code:值得切换到 Rust 智能体框架吗?
  55. Lightpanda AI 智能体浏览器:生产评测与迁移指南
  56. AI 智能体的图工程:知识图谱什么时候值得做?
  57. 多模型 AI 编程智能体技术栈:团队采购指南
  58. MCP 现在无状态了吗?服务器迁移清单
  59. MCP 不是安全边界:如何保护智能体访问的数据
  60. AI 智能体如何互相通信?Band 配置与选型指南
  61. 软件开发机构技术实测 LeanCTX:集成、数据与局限
  62. 用 CLIProxyAPI 在 Claude Code 中运行 GPT-5.6 Sol
  63. 企业级 MCP 授权架构:多租户参考设计
  64. OpenAI 评测沙箱逃逸:测试网络安全 Agent 前的 12 项控制
  65. Meterless 评测 2026:AI 智能体上下文层能否用于生产?
  66. Claude Code vs OpenCode:2026 年团队用哪个更省钱?
  67. Graphify 2026 评测:代码库知识图谱值得引入吗?
  68. AI 试点终止或扩展评分卡:运行 30 天后检查的 12 项指标
  69. T3MP3ST 2026 评测:它能取代渗透测试吗?
  70. Open Knowledge Format(OKF):企业实施指南
  71. AI Agent Cost per Action:为什么 agentic 工作流会推高 token 账单
  72. 如何在 Claude Code 中使用 Claude Fable 5.1
  73. 2026 年 DACH 地区的内部 AI 助手到底要花多少钱
  74. 瓶颈从来不是智能,而是上下文。
  75. DACH 企业怎么选:ChatGPT Enterprise vs Copilot vs 自建 RAG
  76. MCP、RAG、Agent Skills 与 Custom GPTs 怎么选?
  77. 30/60/90 天 AI 智能体试点:上线计划
  78. 面向 SharePoint、Confluence、Drive 的权限优先 RAG
  79. 面向欧盟企业的 RAG 生产就绪清单
  80. AI 代理项目为什么会被取消