技术沉思、行业观察与人物线索,都收在这里。

这里汇总的是 Freelemon 的长文。现在列表页不再只有单一时间线,而是把搜索、标签和专题阅读放到同一层里: 技术沉思 偏系统、方法与工程判断, 访谈 偏一手观点整理与人物表达, 行业观察 偏竞争格局、平台变化与商业判断。

Agent 陪读系列

给刚开始用 Claude、ChatGPT、Cursor、Copilot 和各类 coding agent 干活的人,一条从概念、工程、方法到团队变化的顺读路线。

导读 + 8 篇正片 建议顺序:先读 00,再按 01 到 08 的顺序往下读。 最近更新:08|小团队 + Agent,会不会变成新默认配置
先看导读

Latest Archive

AI Agent 文章归档

这里保留 AI Agent 标签下的时间线。专题区负责导读,这里负责完整归档和顺序回看。

2026-04-11 12:10 北京时间 11 分钟 阅读难度:进阶

Hermes 安装指南:macOS 和 Windows 怎么装

Hermes 不难装。macOS 直接跑官方安装器,Windows 先装 WSL2 再按 Linux 路线装。装完别先闲聊,先用并行读仓库和定时任务两个例子,看看它适不适合你。

  • macOS 原生可装,Windows 走 WSL2,别在原生 PowerShell 路线上耗时间。
阅读全文
2026-04-10 10:25 北京时间 9 分钟 阅读难度:进阶

01|论文精选:这一周最值得看的三条判断

这一周最有价值的论文,同时改了三条判断:个人代理依然很脆弱,自动化 QA 还远不到可托付,竞赛编程 agent 的上限又被往上推了一截。

  • OpenClaw 与 CIK-Bench 给出一个刺眼结果:面对真实网页里的对抗内容,个人 AI 代理的提示注入攻击成功率达到 73.7%。
阅读全文
2026-04-10 10:20 北京时间 8 分钟 阅读难度:进阶

01|GitHub AI 趋势:这一周最值得看的三条线索

这一周 GitHub 上真正有分量的上涨,集中在三类更靠近产品底层的仓库:agent 运行层、端侧推理运行时和全双工语音代理。

  • Hermes Agent 一周新增 14811 星,核心信号不在新 CLI,而在于它把安装、记忆、MCP 和 40 多个工具打成一层可运行的 agent 环境。
阅读全文
2026-04-09 19:35 北京时间 14 分钟 阅读难度:进阶

Anthropic 为什么要把 Managed Agents 做成平台层

Claude Managed Agents 不是一个孤立功能,而是 Anthropic 把 Agent 从模型接口推进到官方运行时平台的一步。真正重要的变化,不是多了几个工具,而是 Anthropic 开始接管 session、memory、vault、observability 和 prompt versioning 这一层基础设施。

  • Anthropic 现在提供的不只是模型,而是一套托管式 agent harness,把 agent、environment、session 和 events 打包成官方平台能力。
阅读全文
2026-04-09 19:20 北京时间 15 分钟 阅读难度:进阶

Claude Managed Agents 的运行时架构是什么

Anthropic 这次公开的不是一个单纯的 agent demo,而是一套正式的运行时抽象。Agent、Environment、Session、Events 这四层一起定义了 Claude Managed Agents 的架构边界,也决定了它更适合长任务、异步执行和托管式运行,而不是完全自定义的 prompt loop。

  • Claude Managed Agents 的核心不是单次请求,而是 `Agent -> Environment -> Session -> Events` 这一套托管运行时抽象。
阅读全文
2026-04-09 08:30 北京时间 6 分钟 阅读难度:进阶

00|GitHub AI 趋势:最近 7 天快涨仓库怎么看

这条线只跟最近 7 天蹿升很快的 AI 仓库,重点判断它们背后到底是新工作流、新工具链还是短期热度,并用文档、活跃度和可复现入口先筛掉噪音。

  • 候选池可以来自 GitHub Trending,但正文判断不能停在榜单截图。
阅读全文
2026-04-09 08:30 北京时间 6 分钟 阅读难度:进阶

00|论文精选:最近 7 天的新论文该怎么挑

这条线只看最近 7 天真正值得工程和产品层继续跟进的 AI 论文,重点判断问题定义、证据强度和落地价值,不做摘要搬运,也不追热点论文名单本身。

  • 默认只看最近 7 天公开的新论文或重要新版本,不靠旧论文翻红撑版面。
阅读全文
2026-04-09 00:27 北京时间 13 分钟 阅读难度:进阶

罗福莉谈 OpenClaw:成本批评成立到哪一步

罗福莉批评 OpenClaw,核心是第三方 Agent 框架终于要自己承担长期运行的成本。把官方计费规则、API 价格和 OpenClaw 近期调整放在一起看,她对单位经济的批评基本成立。

  • 罗福莉批评得最准确的部分,是第三方 Agent 框架不能继续把第一方订阅当成长期补贴。
阅读全文
2026-04-09 00:20 北京时间 20 分钟 阅读难度:硬核

把多窗口 AI 工作流重构成单一控制面

真正需要重构的不是提示词,而是项目控制层。多窗口同时写文章没有错,问题在于写作、主干集成、部署和恢复过去没有被放进同一套状态机里管理;而且这套控制面现在已经开始落成具体脚本和状态文件。

  • 多 Console 并发写作不是问题,真正的问题是过去没有把主干合并和部署收口成单写者流程。
阅读全文
2026-04-09 00:01 北京时间 18 分钟 阅读难度:硬核

Hermes 和 OpenClaw 怎么选:先看层级

Hermes 最近热起来,不代表它会直接替代 OpenClaw。两者都挂着 agent 这面旗,但一个更像执行内核,一个更像个人助手入口和控制平面,个人用户与企业用户后面的答案会完全不同。

  • Hermes 更像 agent runtime,OpenClaw 更像个人助手入口和 control plane。
阅读全文
2026-04-07 22:15 北京时间 更新:2026-04-08 20:42 北京时间 7 min 阅读难度:进阶

02|Coasts 把 agent 运行时问题直接摆出来了

Coasts 把依赖、端口、网络和共享服务这些平时埋在脚手架里的问题直接摆到了产品正面。

  • Coasts 关心的是进程、端口、网络和共享服务怎么一起管。
阅读全文
2026-04-07 21:55 北京时间 更新:2026-04-08 20:42 北京时间 6 min 阅读难度:入门

00|本周 3 篇 Hacker News AI 文章先看哪一篇

这页只做导读:告诉你本周 3 篇分别在讲什么,适合谁先读。

  • 这里只留最近 7 天里能回到原始来源核对的讨论。
阅读全文
2026-04-07 21:22 北京时间 17 分钟 阅读难度:进阶

GSD2 和 OMX 怎么选:两套 AI 编程工作流的分水岭

GSD2 在管项目,OMX 在管 Codex。两边都能做长任务,但不在同一层:一个更像执行内核,一个更像编排外挂。把它们看成同一层工具,后面基本都会用错。

  • GSD2 把项目压成 milestone、slice、task 和落盘状态,更像执行内核。
阅读全文
2026-04-07 10:30 北京时间 15 分钟 阅读难度:进阶

Karpathy 的 LLM Wiki 火了,普通人该怎么用

Karpathy 的 LLM Wiki 之所以引发共鸣,不在于它又发明了一种知识库,而在于它把大模型往“持续整理、持续改写、持续积累”的方向推了一步。

  • 这套方法最有意思的地方,是把问一次答一次的临时问答,变成会留下痕迹的整理流程。
阅读全文
2026-04-04 20:16 北京时间 22 分钟 阅读难度:硬核

Cursor 3.0 和 AI Agent IDE 怎么选

Cursor 3.0 已经不只是更强一点的 AI IDE。真正值得比较的,是它如何和 Windsurf、Copilot、Cline 分别走向不同的 agent 路线:控制台、协作编辑器、GitHub 代理系统和开放执行层。

  • Cursor 3.0 最关键的升级不是换界面,而是把本地与云端 agent 收口成统一调度面。
阅读全文
2026-04-03 17:28 北京时间 16 分钟 阅读难度:硬核

2026 年看 Agent 与大模型,还没做完的六件事

到 2026 年 4 月,主流产品已经把推理、工具调用、短期记忆和基础 Agent 形态做成标配,但真正决定下一代能力上限的几块底盘仍未完成:算力分配、验证器、持续记忆、长时程执行、长上下文工作记忆与可验证推理。

  • 更长的思考时间已经商品化,但“把额外算力稳定转成成功率”仍然没有被产品层彻底解决。
阅读全文
2026-04-02 22:16 北京时间 更新:2026-04-03 14:13 北京时间 14 分钟 阅读难度:进阶

AI 一周办成 700 人大会?一个案例能证明什么,不能证明什么

一篇“用 AI 一周办成 700 人大会”的文章之所以好看,是因为它说对了一半。AI 的确能显著压缩策划、写作、整理和沟通型工作,但一个成功案例还远远不够证明“经验已经失效”或“AI 是主要因”。

  • 现有研究较强支持 AI 抬高新手下限、压缩写作策划类工作的时间成本,但不支持把单个成功故事直接上升为普遍规律。
阅读全文
2026-03-30 00:20 北京时间 更新:2026-03-31 07:20 北京时间 15 分钟 阅读难度:进阶

传统 SaaS 转向 AI:要重写的不只是产品,还有公司结构

传统 SaaS 公司转向 AI,真正难的从来都不在接入一个模型接口,而在定价、交付、组织分工、数据资产和产品边界要一起重写。能不能转型,先是公司战略问题,然后才落到功能层。

  • 这轮转型最后会体现在收入质量和估值逻辑上,核心变量是上下文、动作权限和结果交付,不是页面多几个 AI 按钮。
阅读全文
2026-03-29 00:35 北京时间 10 分钟 阅读难度:进阶

群友的AI Agent协作方法论参考

与 Agent 协作时,最关键的不是把提示词越写越细,而是先判断任务是否落在它的能力边界内,再决定该放手、补足,还是拆解。真正拉开效果差距的,是边界判断、任务粒度、验证机制和干预时机。

  • 控制强度应与能力缺口成正比,覆盖度高就放手,覆盖度一般就补信息,覆盖不了就拆任务。
阅读全文
2026-03-26 21:50 北京时间 4 分钟 阅读难度:进阶

LeWorldModel 的真正价值:给大模型补上一层物理直觉

LeCun 团队的 LeWorldModel 价值不在于“世界模型终局已到”,而在于它用更简单的 JEPA 训练方式,把轻量、快速、可规划的物理建模重新带回了台面。

  • LeWorldModel 证明,小参数世界模型也能在特定控制任务里做到稳定训练、快速规划和有意义的物理表征。
阅读全文
2026-03-26 20:58 北京时间 更新:2026-03-31 07:20 北京时间 22 分钟 阅读难度:硬核

更强 AI 的下一步,也许不在“更像人”这条线上

如果意识不是工程目标,那么更强 AI 的演化方向就没必要沿着“更像人”展开。真正值得追踪的,是架构、记忆、工具使用、世界模型和多代理协作这些更具体的系统变量。

  • 未来更强 AI 的主战场,更像系统架构,而不只是参数规模。
阅读全文
2026-03-25 00:42 北京时间 更新:2026-03-31 00:19 北京时间 17 分钟 阅读难度:硬核

QVeris、LangChain 与 Agent 分层

QVeris 更像能力发现与统一执行层,LangChain、LangGraph 和 Deep Agents 则分别落在 framework、runtime 和 harness。把它们写成同类替代品,会直接讲乱技术栈边界。

  • QVeris 当前公开交付的是 tool search + tool execution,更像能力路由层。
阅读全文
2026-03-25 00:04 北京时间 更新:2026-03-31 00:01 北京时间 12 分钟 阅读难度:进阶

05|YC W26 长周期赌注:研究型公司的时间尺度

CellType、Polymath 和 Ndea 代表的不是同一种 AI 创业,而是三种更长周期的技术押注。评估它们,不能只问今天有没有收入,更要问科学路径、资本结构和下一轮验证点。

  • CellType、Polymath 与 Ndea 的共同点不是都很前沿,而是都更依赖长期研究正确性而不是短期销售效率。
阅读全文
2026-03-25 00:03 北京时间 更新:2026-03-31 00:01 北京时间 15 分钟 阅读难度:进阶

04|YC W26 Physical AI:机器人项目如何穿过部署现实

机器人叙事最容易被 demo 放大,真正决定成败的却是部署、单位经济、数据闭环和现场复杂度。这一批公司值得看,但必须按比 SaaS 更重的现实标准来判断。

  • 机器人应用层最先成立的地方,往往不是通用 humanoid,而是单场景、高 ROI、流程极痛的工业与农业动作。
阅读全文
2026-03-25 00:02 北京时间 更新:2026-04-04 10:51 北京时间 16 分钟 阅读难度:硬核

03|YC W26 Agent 基础设施:谁在争下一层控制点

Agent 基础设施会热,但热不等于都能长成平台。真正需要追问的,是身份、运行时验证、编排、监控和支付之中,哪几层站在动作执行与价值流转的关键入口上。

  • 最值得重视的控制点,是 orchestration、runtime action validation、identity governance 和 payment rails。
阅读全文
2026-03-25 00:01 北京时间 更新:2026-03-31 00:01 北京时间 13 分钟 阅读难度:进阶

02|YC W26 医疗 AI:同一标签下的四条兑现路径

医疗 AI 最容易被一句话讲乱。行政自动化、患者前端、临床辅助与长期管理看上去都在用模型,商业节奏、监管压力和兑现方式却完全不同。

  • 最接近真钱的医疗 AI,往往先发生在前台、计费、排班与保险环节,而不是最宏大的临床叙事。
阅读全文
2026-03-25 00:00 北京时间 更新:2026-03-31 00:19 北京时间 14 分钟 阅读难度:进阶

01|YC W26 收入型 Agent:谁最先逼近真钱

这一组公司最值得看的,不是 agent 叙事本身,而是它们已经切进愿意持续付费的工作流。判断它们的关键,不是模型炫技,而是交付质量、替代强度和留存路径。

  • 结果型 Agent 的关键不在于会不会自主规划,而在于客户愿不愿意按结果持续付费。
阅读全文
2026-03-24 23:18 北京时间 更新:2026-03-31 00:01 北京时间 10 分钟 阅读难度:进阶

00|YC W26 Agent 创业地图:27 家公司该怎么分层

这组稿件不把 YC W26 的 Agent 项目混成一个总口号,而是按结果型产品、医疗、基础设施、机器人和长周期研究五个框架重排。真正重要的不是谁最像 AI 员工,而是谁占住了预算、控制点与时间窗口。

  • 最应该优先看的,是已经切进结果付费工作流的公司,而不是口号最响的通用 Agent。
阅读全文
2026-03-24 12:30 北京时间 更新:2026-04-01 22:58 北京时间 14 分钟 阅读难度:入门

Self-Evolving Agents:自进化研究地图

自进化 agent 听上去像终局叙事,但当前研究真正提供的,更多是一张问题地图:评估如何设计、反馈如何形成、记忆怎样约束、改进怎样不失控。地图重要,胜利尚早。

  • 它的核心贡献不是执行能力,而是把自进化 Agent 研究整理成四条主轴。
阅读全文
2026-03-24 12:26 北京时间 更新:2026-03-31 00:19 北京时间 16 分钟 阅读难度:入门

Swarms:多 Agent 工厂化的野心与代价

Swarms 的吸引力在于它不满足于单个 agent,而是试图把多 agent 策略批量化、模块化、产品化。但一旦走向工厂化,复杂度、调试成本和可靠性问题也会同时放大。

  • Swarms 的核心不是某一种工作流,而是用一组预制架构把多 Agent 协作做成可选择、可切换的策略集合。
阅读全文
2026-03-24 12:22 北京时间 更新:2026-04-01 22:58 北京时间 16 分钟 阅读难度:入门

OxyGent:多 Agent 底盘为什么先要可伸缩

OxyGent 想解决的不是再造一个会聊天的 agent,而是多 agent 协作一旦进入长链路任务,状态、扩展性和系统稳定性如何一起成立。可伸缩性不是锦上添花,而是底盘前提。

  • OxyGent 的核心表达不是某一种固定流程,而是把工具、模型和 Agent 抽象成可拼装的 Oxy 组件。
阅读全文
2026-03-24 12:18 北京时间 更新:2026-04-01 22:58 北京时间 15 分钟 阅读难度:进阶

SICA:在自我进化之前,先把评估做硬

让 coding agent 自我改进听上去像自然下一步,但如果评估体系不够硬,所谓进化很容易只是噪声累积。SICA 的意义,在于先把怎么验证变好摆到系统中心。

  • 这个项目最核心的不是自改代码,而是把自改进收敛成“评估-归档-修改-再评估”的实验闭环。
阅读全文
2026-03-24 12:14 北京时间 更新:2026-03-31 00:19 北京时间 16 分钟 阅读难度:入门

crewAI:把多 Agent 从概念秀拉回工作流

crewAI 值得看的地方,不是把多 agent 说得更宏大,而是把角色分工、任务编排和流程可见性收回到工程可执行的范围。它代表的是多 agent 从演示叙事向工作流产品的回落。

  • crewAI 最早吸引人的是角色协作,后来真正补强的是 Flows、Memory 和可观测性。
阅读全文
2026-03-24 12:10 北京时间 更新:2026-04-01 22:58 北京时间 15 分钟 阅读难度:入门

Agent Orchestrator:并行 Agent 的后勤层

并行 agent 的难点,不在再多开几个模型窗口,而在任务拆分、依赖协调、结果合并与失败回收。Agent Orchestrator 的价值,是把这些后勤工作从演示效果推进成可持续工程。

  • 它的核心,在于给每个 Agent 独立 worktree、分支和 PR 槽位。
阅读全文
2026-03-23 11:30 北京时间 更新:2026-04-01 22:58 北京时间 17 分钟 阅读难度:进阶

从信息流到知识层:怎样筛出值得长期沉淀的可靠知识

做知识库最容易犯的错误,不是漏掉几条信息,而是把所有信息都当知识留下来。真正值得长期保留的,不是“今天重要”的内容,而是 30 天后、90 天后还能支持判断、设计和行动的内容。

  • 信息排序解决的是“今天先看什么”,知识沉淀解决的是“未来还该保留什么”,这两个问题不能共用一个分数。
阅读全文
2026-03-23 00:52 北京时间 18 分钟 阅读难度:硬核

Agentic Web:当 AI 代理开始替人上网

如果主要上网“客户端”逐步从人变成 AI 代理,互联网真正要重写的就不只是搜索入口,还包括接口层、支付层、身份层和预算层。Agentic Web 的核心,正在变成一张机器之间可调用、可结算、可审计的执行网络。

  • 浏览器型代理证明了 AI 已能替人操作网页,但它更像过渡性的义肢,而不是最终形态。
阅读全文
2026-03-22 18:20 北京时间 13 分钟 阅读难度:进阶

WordPress 和 Hexo 之外,独立博主还需要什么

对认真独立建站的博主来说,真正缺的往往不是再多一个博客程序,而是一套能同时承接采集、生成、审计、发布、主题切换和运维的内容操作系统。WordPress 和 Hexo 很成熟,但它们主要解决的仍是上一代建站问题。

  • WordPress 解决的是后台运营,Hexo 解决的是静态生成,但两者都还不是一条 Agent 原生的内容生产线。
阅读全文
2026-03-21 10:40 北京时间 19 分钟 阅读难度:进阶

OpenClaw 全球 B 端与 C 端使用现状对比

截至 2026 年 3 月,OpenClaw 在全球范围内更像一个先在 C 端和 prosumer 层爆发、再被 B 端试点和平台层承接的产品。C 端赢在入口和上手速度,B 端更可能在治理、托管、安全和组织化包装上沉淀收入。

  • OpenClaw 的核心母体仍然是个人 AI 助手,而不是企业软件套件。
阅读全文
2026-03-21 10:35 北京时间 20 分钟 阅读难度:进阶

想建立 2026 年 AI 判断,先别只追新闻

不是再追一轮热点,而是先挑出那些三个月后仍会重写你判断的原文。这 10 篇博客覆盖 Agent 定义、评测偏差、软件工程、推理路线、系统安全和 Agent 公司结构这几条关键线。

  • 这十篇里最重要的不是新名词,而是它们分别重写了定义、评测和工程边界。
阅读全文
2026-03-21 10:30 北京时间 18 分钟 阅读难度:入门

近期最值得看的 10 场 AI 播客与 YouTube 访谈

如果你只想补最近一轮 AI 讨论里最有信息密度的 10 场播客与 YouTube 访谈,这份清单足够覆盖模型、Agent、评测、编码、世界模型、机器人和 AI for Science 这几条主线。

  • 最值得补的不是单条新闻,而是能解释 2026 年技术与产业分岔点的长访谈。
阅读全文
2026-03-21 09:20 北京时间 18 分钟 阅读难度:硬核

谷歌整合 AI Studio 之后,AI 开发市场会怎么变

这次被热传成“AI Studio 四个月重构”的事件,实质是谷歌把 Firebase Studio 的全栈原型能力收进 Google AI Studio,并把重度代码工作收敛到 Antigravity,开始把模型、后端和部署串成一条开发链。

  • 谷歌这次收拢的不是单个前端生成器,而是“模型、原型、后端、部署、本地 IDE”整条开发链。
阅读全文
2026-03-19 19:48 北京时间 23 分钟 阅读难度:入门

当 AI 离开聊天框:张小珺访谈里的机器人、汽车与物理世界

如果前两篇写的是模型公司和 Agent 公司怎样在屏幕里争入口,这一篇写的就是另一件更硬的事:当 AI 要接管汽车、机器人和物理动作时,软件、世界模型、终端与时间尺度会一起改变。

  • 张亚勤把 AGI 画成一张分阶段地图:先信息智能,再物理智能,最后才是生物智能,时间尺度和载体完全不同。
阅读全文
2026-03-19 17:11 北京时间 24 分钟 阅读难度:入门

从张小珺的 AI 深访里,看见 Agent 时代真正的产品线索

把肖弘、明超平、李想这些访谈接起来看,2025 年之后真正的变化不是大家都在做 Agent,而是产品定义从“一个会回答的模型”变成“一个能嵌进环境、持续代办并承接信任关系的活系统”。

  • 肖弘最值得记住的不是 Manus 的热度,而是他对应用公司的方法论:预判模型下一个能力点,先在场景里等它到来。
阅读全文
2026-03-19 09:00 北京时间 9 分钟 阅读难度:进阶

00|AI 进入组织之后,8 个岗位会先重排责任链

这组文章追踪的不是哪类岗位会被 AI 整批替代,而是软件组织里的责任链会如何被重排:哪些执行环节变轻,哪些判断权上移,哪些角色会因为 Agent 变强而重新变贵。

  • 这组系列真正关心的,不是岗位口号,而是责任、边界和交付链会怎样迁移。
阅读全文
2026-03-19 09:00 北京时间 9 分钟 阅读难度:进阶

03. 产品经理在 Agent 时代,会转向成功定义与边界设计

产品经理这类岗位短期更像是在换重心,而不是被整体替代。需求文档、调研摘要和会议纪要会更容易自动化,但成功定义、边界处理和取舍判断会变得更重要。

  • 需求文档和纪要整理会更容易自动化,但目标定义和取舍判断并没有变轻。
阅读全文
2026-03-19 09:00 北京时间 9 分钟 阅读难度:入门

04. 测试工程师会更靠近评测与放行规则

测试工程师不会因为 AI 更会生成用例就自然淡出团队,先变化的更像是测试岗位里的重复执行层。越往前走,测试越会靠近评测工程、verifier 设计、安全边界和放行规则。

  • 最先变化的,是机械执行测试这一层,而不是负责质量边界和放行条件的人。
阅读全文
2026-03-19 09:00 北京时间 10 分钟 阅读难度:入门

05. 架构师在 Agent 时代,会更像运行时设计者

架构师的工作不会因为 AI 更会写代码就自然缩小,真正被重新筛选的,是只停留在图纸层、不碰运行细节的那种工作方式。Agent 时代更稀缺的,是能设计状态、协议、权限和运行边界的人。

  • 先被削弱的,不是架构深度,而是那种长期脱离执行、只在上层画图的工作方式。
阅读全文
2026-03-19 09:00 北京时间 8 分钟 阅读难度:进阶

06. 项目管理进入 Agent 时代之后,会更像流程编排层

项目管理不会整体淡出团队,但信息同步、状态跟进和会议纪要整理这类环节会更早自动化。更有价值的部分,会逐渐转向流程编排、升级路径、依赖管理、人工接管点和例外治理。

  • 状态同步和信息搬运会更早自动化,但例外治理和依赖编排并没有变轻。
阅读全文
2026-03-19 09:00 北京时间 8 分钟 阅读难度:进阶

07. 当 Agent 开始读文档,文档会变成运行时上下文

文档不会因为生成式 AI 普及就失去价值,但那些“为了交付而交付”的说明书会更快商品化。更重要的文档,正在变成 Agent 和人共同消费的运行时上下文与约束层。

  • 低价值文档最容易被生成式 AI 商品化,高价值文档反而会因为 Agent 普及而更重要。
阅读全文
2026-03-19 09:00 北京时间 9 分钟 阅读难度:入门

08. AI 工具扩散之后,IT 部门会更像内部 AI 平台

IT 部门不会因为团队自助用 AI 工具就自然边缘化,先被压缩的更像是装机、开账号和工单分发这类旧式支持工作。接下来更重要的 IT,会更像内部 AI 平台、权限控制和治理团队。

  • 先被压缩的,是 helpdesk 型、工单搬运型 IT,而不是负责身份、权限和审计边界的人。
阅读全文
2026-03-16 13:07 北京时间 更新:2026-03-16 14:10 北京时间 17 分钟 阅读难度:进阶

Pico、Null、Zero 三种 claw 路线怎么分

PicoClaw、NullClaw、ZeroClaw 的名字虽然都带 claw,但它们不是 OpenClaw 官方产品矩阵,更不是简单的大中小版本。三者分别在轻量部署、Zig 极简路线和本地隐私上做了不同取舍。

  • 三只 claw 都有官网和仓库,但不是 OpenClaw 官方产品线。
阅读全文
2026-03-16 07:59 北京时间 更新:2026-03-16 14:10 北京时间 15 分钟 阅读难度:入门

OpenClaw 更像长期在线的 Agent 协调层

OpenClaw 更适合被理解成一层把聊天入口、长连接网关和底层 coding agent 接起来的协调层。它主要解决的是长期在线、跨设备接力和多执行器编排,而不是单次仓库编码的速度比较。

  • OpenClaw 的核心价值不在单次仓库编码速度,而在聊天入口、Gateway 和执行器之间的长期协调。
阅读全文
2026-03-16 03:35 北京时间 24 分钟 阅读难度:硬核

从实践到原则:Harness Engineering 的落地方法

Harness Engineering 不是给 Agent 多接几个工具,而是把代码仓库、执行环境、验证门禁和反馈回路改造成 Agent 可读、可控、可评估的工程系统,让 AI 真正能在真实项目里稳定交付。

  • Harness Engineering 的对象不是单个模型,而是 Agent 所处的整个工程执行环境与治理回路。
阅读全文
2026-03-15 20:38 北京时间 26 分钟 阅读难度:硬核

Pi 内部原理:从会话树到 RPC 接入

Pi 的核心并不神秘:它用 `createAgentSession()` 把模型、资源加载、工具集合、会话树和运行模式装配起来,再由 `AgentSession` 接管工具执行、上下文管理、自动压缩与 RPC 集成。

  • Pi 的核心抽象不是某个界面,而是 `AgentSession` 这层把状态、工具、扩展和模式统一起来的运行时。
阅读全文
2026-03-15 19:52 北京时间 8 分钟 阅读难度:进阶

OpenClaw 把真实 Chrome 会话接进 Agent

OpenClaw 在 `2026.3.13` 更新线里把 live Chrome session attach 做成官方能力,真实浏览器会话第一次进入 Agent 的正式工作流,浏览器插件也从必选项退回到可选路径。

  • 新增 `existing-session` 后,已登录的本机 Chrome 会话第一次成为官方 attach 对象。
阅读全文
2026-03-15 17:57 北京时间 19 分钟 阅读难度:硬核

Pi:OpenClaw 背后的极简 Agent,是怎么工作的

Pi 不是另一个大而全的 Agent 平台,而是一套刻意保持极简的 coding agent harness。它把上下文、工具、会话状态和多种接入方式压成一层轻量执行骨架。

  • Pi 更像一套 coding agent 运行时和 harness,而不是一个把所有功能都打包好的大平台。
阅读全文
2026-03-15 10:06 北京时间 15 分钟 阅读难度:进阶

机器上桌之后之六:Martin Fowler

在 AI Agent 时代,Martin Fowler 之所以仍然很重要,不是因为他代表旧时代的架构教科书,而是因为当生成变快、代理变多、系统边界更容易被穿透时,重构、边界划分、渐进式演化和技术判断反而比以前更像硬约束。

  • Martin Fowler 的重要性,在于他持续把复杂技术变化翻译成团队能执行的工程判断,而不只是抽象观点。
阅读全文
2026-03-15 02:56 北京时间 更新:2026-03-15 11:20 北京时间 16 分钟 阅读难度:入门

文科生如何有效使用 AI Agent 做内容创作

对文科生来说,AI Agent 最有价值的用法,不是整篇代写,而是先接手找资料、拆提纲、改写、多版本分发这些重复环节,让人把精力留在判断、事实核验和语气控制上。

  • 文科生不是 AI Agent 的边缘用户,内容工作反而很适合先从人机协作开始落地。
阅读全文
2026-03-15 02:54 北京时间 更新:2026-03-15 11:25 北京时间 18 分钟 阅读难度:进阶

编程 Agent 的基础结构:模型、工具、状态与验证闭环

编程 Agent 不是更会聊天的聊天框,而是一套能围绕目标读取上下文、调用工具、执行步骤并根据结果继续推进的系统。把这条线看懂,模型、工具、状态和评测这些基础概念就会立刻落地。

  • 理解 Agent 的第一步,不是背一堆名词,而是先看清它和聊天、补全、工作流之间的边界。
阅读全文
2026-03-15 01:17 北京时间 26 分钟 阅读难度:进阶

Java 后端如何转向 AI Agent 工程

Java 后端转向 AI Agent,并不是从零改行,而是把过去积累的系统边界感、异常经验和工具工程能力,重新组织成运行时、评测闭环和治理能力。

  • Java 旧栈不会失效,它会重新定价成工具层、状态层、观测层和治理层能力。
阅读全文
2026-03-14 23:40 北京时间 更新:2026-03-31 18:30 北京时间 18 分钟 阅读难度:进阶

如何转成 AI Agent 工程师:一份基于最新研究的转型路线图

如果你还把 AI Agent 工程师理解成“更会写 Prompt 的人”,那大概率会转错方向。真正有价值的 Agent 工程,是把模型、工具、状态、评测和治理串成可交付系统能力。

  • 从官方实践到最新论文都在指向同一个结论:Agent 工程的核心不是 Prompt,而是系统能力。
阅读全文
2026-03-14 10:30 北京时间 更新:2026-03-31 19:10 北京时间 14 分钟 阅读难度:进阶

Agent 积累的其实是 Knowhow,不只是数据

Agent 的长期价值,主要来自持续沉淀任务拆解、工具调用、异常处理和验证标准这些可迁移的 knowhow,而不只是在数据和微调上继续加码。

  • Agent 的长期进步,更常来自工作流和验证闭环不断变强,不只靠参数自己长出新能力。
阅读全文
2026-03-14 09:00 北京时间 11 分钟 阅读难度:进阶

Clawith:一支 AI 团队的开源样机

Clawith 最有意思的地方,不是把单个 Agent 做得更花,而是认真回答团队协作里身份、权限、触发器、审批和审计怎样一起落地,并让多 Agent 真正进入组织工作流。

  • Clawith 的新意不在模型层,而在把 Agent 当成带身份和关系的组织成员来设计。
阅读全文
2026-03-13 22:00 北京时间 更新:2026-04-02 00:14 北京时间 10 分钟 阅读难度:入门

访谈:Harrison Chase 谈 Harness

这篇访谈围绕 Harrison Chase 的核心判断展开:Agent 时代真正要重建的,不只是模型接口,而是一整套执行、上下文和人类协同基础设施。

  • 这期访谈的重点不是模型升级,而是 Agent 的底层运行方式正在整体重建。
阅读全文
2026-03-13 20:30 北京时间 更新:2026-03-31 07:05 北京时间 16 分钟 阅读难度:进阶

现在做 Agent 产品,最该补哪一层缺口

现在做 Agent 产品,更值得补的是那层把 runtime、审批、回滚和团队规则接进真实工作流的控制层。系统层和平台层都已有强手,组织如何接住 Agent 反而还是空白。

  • 系统层最像产品,平台层最像底座,但两边都已经出现清晰强手。
阅读全文
2026-03-13 20:00 北京时间 更新:2026-03-31 07:28 北京时间 24 分钟 阅读难度:进阶

平台层争夺战:谁会成为 Agent 基础设施

平台层决定的是 Agent 能不能长期、稳定、可治理地跑起来。眼下最值得看的四条路线,分别是 LangGraph、微软、OpenAI 和 AWS 所代表的平台化方向。

  • LangGraph 目前最像开放生态里的头号平台层选手,优势在 durable execution 和状态工作流。
阅读全文
2026-03-13 19:30 北京时间 更新:2026-03-31 18:30 北京时间 22 分钟 阅读难度:硬核

做 Agent 系统前,先看懂系统、平台与工具版图

如果你想做的是能承接长任务、异步执行和团队协作的 Agent 产品,动手前先看清系统、平台、工具三层版图。它们解决的问题不同,拿到的入口不同,真正留下的缺口也不同。

  • 市场已经分成系统、平台、工具三层,三类玩家的强项和边界并不相同。
阅读全文
2026-03-13 19:00 北京时间 更新:2026-03-31 18:30 北京时间 18 分钟 阅读难度:硬核

长时间 AI Agent:从研究叙事到生产系统

长时间 Agent 的真正难点,不在单步够不够聪明,而在跨很多轮、很多上下文和很多工具调用之后,能不能继续保持状态连续、结果可验证和错误可恢复。

  • METR 证明的是任务跨度能力在增长,不等于企业级稳定性已经成熟。
阅读全文
2026-03-13 18:30 北京时间 更新:2026-03-31 19:10 北京时间 22 分钟 阅读难度:硬核

长时间 AI Agent 生产架构蓝图

如果一个 Agent 要连续运行二十分钟、两小时甚至更久,系统默认该长什么样?这篇文章把分层架构、状态模型、检查点、验证和上线顺序全部拆开讲清楚。

  • 默认架构不是一个 Agent 跑到底,而是让 Orchestrator 调度很多短而可验证的小步骤。
阅读全文
2026-03-13 18:00 北京时间 19 分钟 阅读难度:进阶

OpenClaw 爆火之后,谁在卖工具,谁在卖云,谁在卖入口

OpenClaw 不是又一个热闹的 AI 玩具,而是一根很清楚的产业探针。它暴露了一件事:当 AI 编码从聊天升级为工作流,产业链每一层都会重新找位置,重新争入口和运行时。

  • OpenClaw 的意义不只在项目爆火,而在 AI 编码工作流第一次低门槛跨过开发者圈层。
阅读全文