Post-Code Engineering Lab
探索后代码时代
的工程范式
AI-Native 软件工程实验室 · 记录正在发生的变化
从代码到意图,从工具到基础设施
287 篇文章
612 个标签
4 个系列
01
系列专题
02
最新文章
287 篇 2026-09-01 规格即控制面:MAGE 如何把架构治理变成可计算的基础设施 TL;DR 本文核心观点: 写代码变便宜后,真正的稀缺品回到了控制权 — 谁定义对、谁决定够好、谁来签字负责,比实现能力更值钱 ... → 2026-08-31 Kozuchi Agent:本地 27B 权重怎么做审计友好的代码修复 TL;DR 本文核心观点: 不微调、本地跑 Qwen3.5-27B,靠 scaffold 工程达到 SWE-bench Veri... → 2026-08-31 SpecPath:同一个需求,换种说法就修出不同的 bug TL;DR 本文核心观点: 规格路径敏感性(Specification-Path Sensitivity) — 语义等价的最终契... → 2026-08-31 EpisodicFreeze:工作记忆与长期存储的解耦设计 TL;DR 本文核心观点: 上下文窗口不是记忆 — 上下文窗口是工作记忆的载体,session 结束就清空;真正的长期记忆需要持... → 2026-08-31 DDBench:Coding Agent 的分布式调试深水区评测 TL;DR 本文核心观点: 单进程基准已饱和,分布式调试是新盲区 — 60 个历史 bug,13 个开源分布式系统,三级难度分区... → 2026-08-31 Agent 读文档和人想的不一样:来自 557 个真实 session 的行为证据 TL;DR 本文核心观点: 60.5% 的文档交互落在 agent 面向制品 — instruction files(AGENT... → 2026-08-31 规格优先:717k 行 TS 代码库上的零人工 review 架构重构 TL;DR 本文核心观点: 规格优先 SCE 协议 — 形式化规格 → 规格 vs 源码审查 → 原子实现 → 编译测试 → 代... → 2026-08-31 LoopsBench:评测尺子该换了——从 Harness 到 Loop TL;DR 本文核心观点: 评测对象从 Harness 上移到 Loop — 现有基准只看「最终 patch 过没过」,Loop... → 2026-08-31 ContractAgent:当工具接口带上类型合约 TL;DR 本文核心观点: 工具描述的语义空洞 — 标准工具 schema 只说怎么调,不说何时能用、调用后状态如何变化,Age... → 2026-08-31 代码作为 Agent Harness:代码不再是输出,而是 Agent 的身体 TL;DR 本文核心观点: 代码角色的根本转变 — 代码不再是 LLM 交出的作业,而是包裹模型的运行时外骨骼:承担 reaso... →