Post-Code Engineering Lab
探索后代码时代
的工程范式
AI-Native 软件工程实验室 · 记录正在发生的变化
从代码到意图,从工具到基础设施
287 篇文章
612 个标签
4 个系列
01
系列专题
02
最新文章
287 篇 2026-09-02 DeepAgent:从预定义工具到自主发现 TL;DR DeepAgent 打破了预定义工具的限制,在推理过程中从 16,000+ RapidAPI 工具库中动态检索和调用工具,配合脑启... → 2026-09-02 半可执行栈:软件工程边界正在扩大 TL;DR Feldt(Chalmers)在 Agentic Engineering 2026 主旨演讲中提出六环诊断模型:软件工程制品按可执... → 2026-09-02 多轮对话中的回归累积:Vibe Coding 的真实失效模式 TL;DR 单轮 HumanEval 高分严重高估可靠性。研究将 HumanEval+/MBPP+ 改造成 8 轮需求演化链,发现 40%–7... → 2026-09-02 AnalysisAgent:LLM Agent 装配分析工具的七个陷阱 TL;DR 首次系统评测 LLM Agent 在「给项目装配并跑通静态分析/符号执行工具」任务上的表现。35 个 tool-project 对... → 2026-09-02 Agent 工程的三个隐性失败模式:多轮退化、栈层盲区、工具断环 TL;DR 过去十几期文章的核心议题是「生成质量」——怎么让 AI 写出更好的代码、更准确的文档、更合理的架构。但本期三篇论文揭示了一个更根本... → 2026-09-01 PROGRA:给 Agent 装上进度条——ACL 2026 多轮函数调用的里程碑 TL;DR 本文核心观点: PROGRA 精准命中了 Agent 落地的核心痛点 — 真实业务场景(客服、订单处理)需要多轮交互... → 2026-09-01 Strat-Reasoner:让 Agent 在博弈中学会「揣摩他者」 TL;DR 本文核心观点: Strat-Reasoner 将「理解对手」变成可优化的目标 — 传统 RL 只看输赢,Strat-... → 2026-09-01 MIA:让 Agent 在推理过程中实时进化——双重记忆系统的闭环 TL;DR 本文核心观点: MIA 的双重记忆系统是最大亮点 — 非参数记忆负责沉淀经验,参数记忆负责吸收能力,二者通过双向转换... → 2026-09-01 对抗式少体协作:Adversarial Review 如何用结构化异议破解 false-consensus TL;DR 本文核心观点: false-consensus 是多 agent 评审的主要失败模式 — 无证据约束的多数投票,本质... → 2026-09-01 路由即裁判:Risa 如何用 MoE 内部信号做零成本仲裁 TL;DR 本文核心观点: Risa 把 MoE 路由器当零成本裁判 — 长轨迹 coding agent 重复采样时,原生 r... →