AI Native Digest 2026-09-15

今天关注 AI-native 系统的两个工程化方向:AWS 用 Step Functions 把多 Agent 的 fan-out、validation、human gate 与副作用执行移到确定性 control plane 中,形成 agents propose、deterministic code validates 的生产模式;Google Cloud 则把 Skills、MCP 与 guardrails 打包成跨 Codex、Claude Code、Antigravity 可安装的 Agent Plugin,说明 Agent 能力分发正在从零散配置走向标准化 package。

September 15, 2026 · 2 min · Cedric

AI Native Digest 2026-09-14

今天关注 AI-native 软件工程的两个底层设计问题:Yad Konrad 用 program synthesis / CEGIS 重新解释 prompt、context、harness、eval 与 software factory,指出它们其实是在重新发现 specification、search space、search technique 和 verifier;另一篇新论文则直接比较 Agent Skills 与 Subagents,证明可复用知识该放进主 context 还是隔离到独立 subagent,关键取决于技能是否具有清晰的输入输出契约。

September 14, 2026 · 2 min · Cedric

AI Native Digest 2026-09-13

今天关注 AI-native 软件工程的两个新方向:Cursor Projects 把 coding agent 从单次会话推进为可持续数月、拥有共享上下文和 coordinator/subagent 架构的长期工作单元;Cognition 的 SWE-2 则直接把任务成功率与推理成本一起写进 RL 目标,说明 coding agent 的优化正在从单纯追求 benchmark 分数转向整条 cost-performance Pareto frontier。

September 13, 2026 · 1 min · Cedric

AI Native Digest 2026-09-12

今天关注 AI-native 软件工程从单个 Agent 走向平台化运行的两个方向:OpenAI 把 Codex harness 作为托管 Agents API 开放,直接提供长会话、context compaction、tool search 和 subagent orchestration;Atlassian 则把 shared context、organizational standards、always-on agent loops 和效果度量组合成 governed AI-native SDLC。

September 12, 2026 · 2 min · Cedric

AI Native Digest 2026-09-11

今天关注 AI-native Agent 的两个结构性可靠性问题:Meta 用 Secure VM、credential isolation 和独立 Sentinel 把个人 Agent 的权限控制移出模型;ExecCritic 则证明 coding agent 的执行反馈只有在测试本身可信时才有价值,并用独立 Test Agent + fail-closed harness 避免 Agent 自己给自己验收。

September 11, 2026 · 2 min · Cedric

AI Native Digest 2026-09-10

今天关注 AI-native 软件工程的两个可靠性基础:AWS 把 agent evaluation 直接接进 GitHub Actions,让 Agent 行为回归像代码回归一样阻断合并;Scanning the Harness 则把 skills、MCP、hooks 和权限配置视为新的软件供应链,并量化真实仓库中的缺陷比例。

September 10, 2026 · 2 min · Cedric

AI Native Digest 2026-09-09

今天关注 AI-native 软件工程从个人 Agent 到组织级系统的两个跃迁:OpenAI 用内部数据展示 coding agents 如何进入研究生产流水线;Mastra 则公开自己的 software factory,展示 staged automation、observational memory 和可配置 human gates 如何把 Agent 接入真实 issue/PR 工作流。

September 9, 2026 · 2 min · Cedric

AI Native Digest 2026-09-08

今天关注 AI-native Agent 的两个关键问题:Basis 把 context 当作生产输入,并用 behavior spec 对长周期 Agent 的过程行为进行可验证约束;HarnessDev 则把评测对象从任务输出推进到 harness 本身,研究模型能否创建并持续演化自己的执行基础设施。

September 8, 2026 · 2 min · Cedric

AI Native Digest 2026-09-06

今天关注 AI-native 软件工程的两个 runtime/control-plane 问题:GitHub HydraFusion 用动态多模型编排优化 coding agent 的质量-成本曲线;Cloudflare 则把代码、生产流量和安全证据接进同一个漏洞发现与修复 Agent workflow。

September 6, 2026 · 2 min · Cedric

AI Native Digest 2026-09-05

今天关注 AI-native 软件工程的两个关键层:O’Reilly 用实际 software factory 经验把 SDLC 拆成可控的 Agent 流水线;Repo-To-Skill 则尝试把 GitHub 仓库里的工程 know-how 蒸馏成可验证、可路由的 Agent Skills。

September 5, 2026 · 2 min · Cedric