v0.15.3 · Open-source · MIT License

AI 负责起草。
代码负责把关。
由你最终批准。

一个开源治理 harness,在 AI 简报交付前识别知识冲突、
阻断错误版本,并保留可审计记录。

MIT License

QUALITY PANEL — 审计单
门禁:通过 AI:建议
已拦截:日期冲突

策略更新日期写为 2026-06-31,与事实不一致。

RUN-2026-0824 · sha256:9c41f2… · python 3.12.8 2026-07-17 21:46 UTC
Agent 负责起草——没有交付权
Python 负责把关——确定性执行
你来批准——每次如此
See it catch · 看它抓错

三种最常见的错误:直接生成会溜进终稿,走 BriefLoop 会被挡下

切换下面三个典型合成场景,看同一份材料两种交付方式的差别。

原始材料

一次性直接生成 看起来已完成 ✓

读起来通顺、自信——错误就藏在里面,没有任何提示。

使用 BriefLoop 草稿 · revision 1
哪里错了?
根据什么发现?
为什么不能交付?
修复后应该怎么写?
BriefLoop 没有证明什么?
查看审计详情(开发者视角)

合成案例,用于解释工作流,不代表自动事实核查基准。

Compare · 对比

不是更长的 Prompt,而是 AI 之外的交付规则

Prompt 和 Skill 告诉 Agent「应该怎么做」;BriefLoop 记录它「实际做了什么」,并决定哪一版有资格交付。

最大的区别不是多一个审稿 Agent,而是写稿的 Agent 没有权把自己的稿子直接宣布为「可以交付」

负责「写」

ChatGPT + 长 Prompt

写得好,但规则只活在这一次对话里。

负责「跑」

Agent Runtime + Skill.md

能调工具、跑多步,但写稿和裁判还是同一个。

负责「管住交付」

BriefLoop

把关键事实、检查和批准放到 Agent 之外。

ChatGPT + 长 Prompt Agent Runtime + Skill.md BriefLoop
主要作用生成内容自动执行任务管理报告从草稿到交付
规则如何生效Agent 按 Prompt 理解遵守Agent 按 Skill 和 Runtime 执行关键边界由外部状态、程序检查和权限控制
谁判断任务完成通常是模型或用户通常是 Agent 或 Runtime 流程写稿 Agent 无权单独宣布可交付
关键数字如何保存存在于材料和对话中可能保存在中间文件中关键事实单独登记,改动必须留痕
发现错误后继续对话、重新生成Agent 重试或重跑步骤问题入账,阻断交付,修复后重新检查
哪一版算最终稿最后一次回答或生成的文件Agent 标记完成的结果通过检查并获批准的版本
运行中断后依赖聊天记录和上下文取决于 Runtime 是否存状态根据工件和运行记录恢复
最适合一次性、低风险写作多步骤自动化重复、高风险、多人复核的正式报告

ChatGPT 负责想和写,Skill 负责教它怎么做,Runtime 负责让它跑起来,BriefLoop 负责记账、拦截和放行

诚实说明

这些能力 Agent Runtime 自己也能实现——但都做完,其实就是在重建 BriefLoop。区别不是别人做不到,而是你不必每个团队再用 Prompt 和脚本各拼一遍

Skill 是「请你这样做」,BriefLoop 是「没做到这一步,就过不去」。

How it works · 工作方式

四步,把 AI 草稿变成敢交付的最终稿

01

把资料交给 AI

本地文件、报告、表格,或已登记的网页材料。

02

AI 起草报告

目前通过 Codex 起草。

03

BriefLoop 对照来源和规则检查

看数字有没有出处、材料是否过期、是否突然多出新的重要结论。

04

问题退回修改,人确认后交付

未处理的问题不会被当成最终稿。放行的永远是人,且留有记录。

查看技术细节

v0.15.3 的新运行只走 Experimental Codex SQLite 路径。SQLite ControlStore(briefloop.db)及其收据、账本关系是唯一运行权威;Agent 只能写 invocation scratch 提案,确定性服务才可接受并生效。旧 JSON 控制面已删除,不能导入或双写。legacy JSON 控制文件与报告、status、Quality Panel、Markdown/JSON/JSONL/HTML 导出是非权威投影。strict action、envelope 与 human-request JSON 只是写边界载体,必须重新对照 ControlStore 校验,自身不构成权威。完整机制见 运作原理

What you get · 交付物

不只是一份报告,而是一套「可以被追问」的交付

先看它有什么用,文件名点开再看。

Quality Panel · 质量面板

支持的运行可以生成一张 Quality Panel

v0.15.3 可导出一份自包含的只读 HTML:Brief、Quality、Market Data、LAJ 建议、改进状态。它只是 Store/LAJ 的展示投影,不是运行权威、质量评分或交付裁决;LAJ 为 Experimental,效用 NOT MEASURED。

合成数据 · 只读展示。第三页会如实显示 Improvement Ledger unavailable;页面没有处置、写入或“接受建议后改善下次运行”的能力。

Controlled comparison · 对照实验

同一项周报任务,三种方法

相同时间窗、来源包、模型与交付要求。真实运行完成并核验后,这里会公开三份成品、问题记录与运行包;不把“看起来最好”的一次挑出来当结论。

A0 · 筹备中

长 Prompt 直出

相同来源包与报告要求下,一次性生成的周报及其原始运行记录。

同一来源同一模型待公开
运行包准备中
A1 · 筹备中

Skill + Agent Runtime

相同来源包与报告要求下,Agent 使用公开 Skill 完成的周报与运行记录。

同一来源同一模型待公开
运行包准备中
A2 · 筹备中

BriefLoop 工作流

相同来源包与报告要求下,附事实登记、问题记录、修复与人工放行状态。

同一来源同一模型待公开
运行包准备中
Use cases · 使用场景

你每周要交什么,BriefLoop 就帮你守住那一份

三类最常见的定期交付,各自最容易出的问题。

行业与竞品周报

要交:每周的行业动向和竞品跟踪。

常拦住:多轮改稿后混入的未证实数据和观点;核心数字先冻结再润色。

管理层月报

要交:给管理层的月度经营与决策简报。

常拦住:把「预计」写成「已完成」、过于绝对且缺乏归因的结论。

文档证据审阅

要交:对 AI 草稿做出处与合规复核的结论。

常拦住:过期或无依据的陈述被标记并阻断,复核只看例外。

Boundary · 边界

帮你查清楚,但不替你拍板

BriefLoop 不会自动证明某句话绝对正确,也不会替代法律、合规或管理层判断。它做的是把出处、冲突、过期材料和未解决问题摆到你面前,并防止这些问题被悄悄当成最终稿。

举个例子:它不会证明「需求一定没有回暖」;它只是指出,当前提供的材料不足以支持这个结论。

v0.15.3 · 已发布

体验当前版本

以下页面展示 v0.15.3 的产品边界;均为合成数据,只用于说明界面,不构成能力测量结果。

v0.15.3 · READ-ONLY DEMO

交互式向导 init

真实 briefloop init --web 是 Experimental 的本地一次性向导;本站页面只是只读界面预览,不创建工作区、不提交事务。

打开设计预览 →
EXPERIMENTAL · NOT MEASURED

AI Second Opinion

终稿后的 advisory 第二意见,不影响 Gate、交付、批准、下一动作或事实支持结论;效用 NOT MEASURED。

打开设计预览 →
UNAVAILABLE ON THIS PAGE

改进页

HTML 的 Improvement 页只读显示不可用。没有自动学习。v0.15.3 的人工观察与批准指导走 Store Receipt,下一轮只有显式 --include-approved-guidance 才会带入。

打开只读预览 →
Get started · 怎么开始

两种方式,几分钟开始用

不用装任何东西也能先看它抓错;想本地跑起来,下面二选一。

方式二 · 源码安装

粘贴到 macOS / Linux 终端

git clone https://github.com/Stahl-G/briefloop.git cd briefloop && bash scripts/setup.sh

需要 Python 3.12。装好后 source .venv/bin/activate,可先跑 bash scripts/demo.sh。建工作区用 briefloop new industry-weekly ./my-weekly,或先 briefloop onboardinit --from-onboarding。Windows 请使用 PowerShell 安装路径,不要把这两行 Bash 改写到 Git Bash。pipx install briefloop 目前不是启动路径。

想先在线体验?看三个抓错演示。完整安装与治理细节见 Agent 安装说明运作原理。当前能力边界以仓库里的 architecture-status 为准;页面上的 架构参考 v0.6.1 是 v0.12.1 代码快照,不是 v0.15.3 能力声明。