16 KiB
PJ2026-0202 编辑策划需求规格
修改历史
| 版本 | 对应 commit id | 更新日期 | 变更说明 |
|---|---|---|---|
| v0.1 | 2fdadce8 |
2026-07-13 | 定义结构化文稿、质量门、专业对象补充和来源闭环的目标能力。 |
正文
PJ2026-0202 编辑策划需求规格
1. 文档控制
| 字段 | 内容 |
|---|---|
| 编号 | PJ2026-0202 |
| 短名 | 编辑策划 |
| 层级 | L1 方向 |
| 规格状态 | 已生效 |
| 实现引用版本 | draft-2026-07-13-p0 |
| 需求规格模板 | ISO/IEC/IEEE 29148 需求规格模板 |
| 上级规格 | PJ2026-02 智媒工厂总规格 |
| 规格治理索引 | PJ2026-02 智媒工厂总规格 第 7 章 |
本文采用 ISO/IEC/IEEE 29148 需求规格模板的项目裁剪版。
正文只定义:
- 选题、事实核验、栏目结构、叙事和引用的预期终态;
- 对应验收契约。
2. 目的和范围
2.1 目的
编辑策划负责:
- 把可追溯来源转化为有判断、有信息密度、适合技术受众收听的栏目内容;
- 决定本期为什么讲这些消息;
- 决定每条消息要解释到什么深度,并把必要事实边界放在相关表述处;
- 让开场与大纲、逐条故事和参考来源形成连贯叙事;
- 避免把来源摘要机械拼接成“AI 味”文稿。
2.2 范围内
- 栏目定位、受众假设、期次题目、候选池、选题数量和内容优先级。
- 固定开场、五十字内概述、卡片大纲、单条故事和参考来源口播结构。
- 事实锚点、日期、数字、产品状态、媒体归因、预印本和活动条件的表达边界。
- 按受众熟悉度补充专业对象的功能、作者、公司、发布者或大学团队来源。
- 结构化文稿、配音文本、视觉方向、来源引用和评论区来源文本的内容一致性。
- 授权 LLM 生成、质量门重试和完全离线模板路径。
2.3 范围外
- 来源抓取、去重、分类和原始证据保存,归 资讯源。
- HTML 画面、页面滚动、演示文稿和封面,归 视觉制作。
- 音色、语速、字幕断句和视频编码,归 音频成片。
- 发布批准、平台文案投放和效果反馈归档,归 发布运营。
- 通过杜撰数字、空泛预测、夸张标题或隐去限制提升戏剧性。
3. 术语表
| 术语 | 定义 |
|---|---|
| 事实锚点 | 能由来源证据直接支持且决定一条资讯核心价值的日期、状态、数字、动作或对象关系。 |
| 质量门 | 在接受文稿前检查结构、长度、证据、空泛表达、状态限定和引用完整性的规则集合。 |
| 受众熟悉度 | 对目标受众是否可合理推断已经认识某个对象的编辑判断。 |
| 专业对象补充 | 对陌生库、组件、框架、协议或项目补充其功能和发布者的短句。 |
| 状态限定 | 对 beta、预览、预印本、临时调整、媒体报道、地区限制等事实边界的明确表达。 |
| 镜头意图 | 文稿为视觉制作提供的信息重点、来源页面和画面节奏建议,不是最终视觉实现。 |
| 结构化文稿 | 包含开场与大纲、故事、参考来源、配音单元和来源引用关系的机器可读工件。 |
| 模板模式 | 不调用 LLM、根据来源和固定规则生成可调试文稿的离线路径。 |
4. 系统边界和接口
本规格把编辑策划作为内容判断和结构化表达能力看待,不负责来源网络和媒体渲染。
| 边界项 | 内容 |
|---|---|
| 外部使用者 | 栏目编辑、审核者、视觉制作、音频成片和发布运营。 |
| 外部输入 | 期次元数据、来源候选池、栏目规则、受众熟悉对象、人工编辑意见和可选 LLM 响应。 |
| 受控资源 | 选题结果、结构化文稿、质量门反馈、配音单元、镜头意图、来源引用和引用目录。 |
| 外部输出 | 开场与大纲、故事、参考来源口播、配音文本、视觉方向和可解析引用。 |
| 用户接口 | TypeScript CLI 文稿单步、可编辑 JSON/TXT/Markdown 工件、日志和 Web 文稿视图。 |
| 系统边界 | 编辑策划负责“说什么以及如何准确地说”;不负责来源可访问性、画面制作、声音表现和最终发布批准。 |
5. 内部分工与下级索引
| 编号 | 模块或课题 | 规格位置 | 主责边界 | 上游依赖 | 下游支撑 |
|---|---|---|---|---|---|
| PJ2026-020201 | 栏目策划 | 本规格 6.1 | 栏目定位、受众、期次结构和选题组合 | 期次元数据、来源候选 | 全部编辑环节 |
| PJ2026-020202 | 事实核验 | 本规格 6.2 | 锚点、状态、数字、日期、归因和不能推出的结论 | 资讯源 | 文稿生成、发布复核 |
| PJ2026-020203 | 口播叙事 | 本规格 6.3 | 开场与大纲、故事、来源转场、节奏和语言质量 | 栏目策划、事实核验 | 视觉制作、音频成片 |
| PJ2026-020204 | 对象补充 | 本规格 6.4 | 专业对象功能、作者或发布者说明与熟悉对象免补充 | 事实核验、受众规则 | 口播叙事 |
| PJ2026-020205 | 文稿质量 | 本规格 6.5 | 生成、重试、质量门、模板路径和人工覆盖 | 全部编辑环节 | 流水线平台 |
| PJ2026-020206 | 引用闭环 | 本规格 6.6 | 文稿到来源、镜头、配音和发布引用的一致关系 | 资讯源、结构化文稿 | 发布运营 |
本章图形描述编辑策划的预期终态数据面。
5.1 目标数据面架构图
flowchart LR
subgraph Inputs[编辑输入]
Edition[期次元数据]
Sources[来源候选与证据]
Rules[栏目与受众规则]
Human[人工编辑意见]
end
subgraph EditorialPlane[编辑策划数据面]
Planner[选题组合]
Evidence[事实锚点与状态]
Generator[LLM 或模板生成]
Gate[结构与事实质量门]
Assembler[确定性内容组装]
end
Edition --> Planner
Sources --> Planner
Rules --> Planner
Human --> Planner
Planner --> Evidence
Evidence --> Generator
Rules --> Generator
Generator --> Gate
Gate --> Assembler
Assembler --> Script[结构化文稿]
Assembler --> Citations[引用与配音文本]
确定性组装器拥有期数、日期、固定开场和引用顺序。生成模型不能越过质量门直接成为下游内容真相。
5.2 目标数据流图
flowchart TD
Pool[可追溯候选池] --> Select[按价值与组合选题]
Select --> Evidence[提取事实锚点与限制]
Evidence --> Audience[判断受众熟悉度]
Audience --> Draft[生成开场与大纲 / 故事 / 来源转场]
Draft --> Gate[结构、证据与语言质量门]
Gate -->|拒绝并反馈| Draft
Gate -->|接受| Script[结构化文稿]
Script --> Visual[镜头意图]
Script --> Audio[配音单元]
Script --> Publish[来源引用与评论区文本]
质量门拒绝必须产生具体反馈并进入下一次生成或人工修订,不能只重复同一提示。被拒绝响应仍属于可观察的 LLM 尝试和成本事实。
5.3 关键时序图
sequenceDiagram
participant E as 编辑者
participant P as 流水线平台
participant S as 来源清单
participant G as 文稿生成器
participant U as 用量记录
participant Q as 质量门
participant A as 文稿工件
E->>P: 提交 script 单步
P->>S: 读取候选与来源证据
P->>G: 传入栏目规则和有界证据
alt 模板模式
G-->>P: 模板结构化草稿
else 授权 LLM
loop 直到接受或达到上限
G-->>P: 模型响应与 usage
P->>U: 记录本次尝试和费用状态
P->>Q: 校验结构、事实和表达
alt 被拒绝
Q-->>G: 返回具体修订反馈
else 接受
Q-->>P: 接受结构化内容
end
end
end
P->>A: 组装开场、正文、引用与配音单元
P-->>E: 返回文稿、引用和质量摘要
模板模式不得读取 LLM 凭据。模型尝试即使被拒绝,也必须先写入用量与质量结果再进入下一次尝试。
6. 原子需求
6.1 EDIT-L1-REQ-001 栏目化选题
| 编号 | 短名 | 主责模块 | 关联模块 |
|---|---|---|---|
| EDIT-L1-REQ-001 | 栏目选题 | PJ2026-020201 栏目策划 | 资讯源、发布运营 |
系统应根据以下条件形成一期选题:
- 栏目定位和报道日期;
- 目标时长和受众;
- 内容优先级和候选证据;
- 主题组合和实用价值。
系统不得只选择得分最高或标题最热的若干条。
默认栏目组合规则如下:
- 优先嵌入式与 AI 交叉;
- 其次纯嵌入式;
- 再次 AI;
- 避免同一期内容都属于同一厂商、同一产品或同一种发布形式;
- 优惠和供应链变化只有与技术受众实际决策相关时才可入选。
选题完成标准包括来源足够、日期和状态明确、受众价值可以用一句话说明、节目组合有层次。候选证据不足时应减少条目或明确失败,不能用空泛评论补齐数量。
6.2 EDIT-L1-REQ-002 事实与状态核验
| 编号 | 短名 | 主责模块 | 关联模块 |
|---|---|---|---|
| EDIT-L1-REQ-002 | 事实核验 | PJ2026-020202 事实核验 | 资讯源、发布运营 |
系统应在写稿前为每条入选资讯确定事实锚点、来源角色和状态边界,并要求文稿只陈述来源能够支持的内容。
具体事实使用规则如下:
- 日期、版本、处理器、内存、价格、性能和截止时间只有在证据明确时才能出现;
- 来源未提供延迟、功耗、精度、兼容性或开放范围时,不得编造相关结论;
- 不能用行业常识填成该产品事实。
事实边界表达应满足:
- 必要的状态或适用范围放在相关事实附近;
- 不在每条故事末尾机械添加局限、约束、限制或风险;
- 不使用“仍需验证”类固定收尾句。
媒体报道必须说“媒体报道”或点明媒体;大学论文只有在来源明确单位时才说“来自某大学团队”,否则使用“作者团队”;预印本不得暗示已经同行评审。
6.3 EDIT-L1-REQ-003 固定栏目结构
| 编号 | 短名 | 主责模块 | 关联模块 |
|---|---|---|---|
| EDIT-L1-REQ-003 | 口播结构 | PJ2026-020203 口播叙事 | 视觉制作、音频成片 |
系统应生成稳定但不僵硬的栏目结构,至少包含合并的开场与卡片式大纲、逐条资讯和参考来源口播。
开场应使用期次元数据确定性生成:
- 报出期数、栏目名和日期;
- 使用“主要内容有”引出不超过五十字的概述;
- 在同一开场场景中展示卡片式大纲;
- 使用“下面是详细内容”进入正文;
- 不允许 LLM 改写期数、日期或固定句式。
栏目叙事顺序如下:
- 每条故事先给核心变化;
- 再解释技术或业务影响;
- 以正面、具体、可核验的功能、行动价值或后续动向自然收束;
- 最后一条故事结束后直接进入参考来源,不生成总结段或总结场景;
- 参考来源口播固定为“以下是这期《栏目名》的参考来源,完整链接见评论区”。
6.4 EDIT-L1-REQ-004 受众适配说明
| 编号 | 短名 | 主责模块 | 关联模块 |
|---|---|---|---|
| EDIT-L1-REQ-004 | 对象补充 | PJ2026-020204 对象补充 | PJ2026-020202 事实核验、PJ2026-020203 口播叙事 |
系统应根据受众熟悉度决定是否补充短介绍:
- GPT、Claude、ESP32 等可合理推断目标受众熟悉的对象可以直接进入新消息;
- 专门的库、组件、框架、协议或项目应补充其功能和发布者。
补充句应说明:
- 它是什么;
- 解决什么问题;
- 由谁发布或维护。
只使用来源支持的作者、公司、机构或团队信息。不能编造公司归属,也不能把仓库组织名自动当作法人或作者身份。
补充句服务理解,不应盖过新资讯本身;同一条口播首次介绍后不重复堆叠定义。
6.5 EDIT-L1-REQ-005 可审查文稿生成
| 编号 | 短名 | 主责模块 | 关联模块 |
|---|---|---|---|
| EDIT-L1-REQ-005 | 文稿质量 | PJ2026-020205 文稿质量 | 流水线平台、音频成片 |
系统应同时提供授权 LLM 和模板模式,并把两者输出为同一结构化文稿契约。LLM 只接收任务所需的来源证据和栏目规则,凭据不能进入提示词、工件或日志。
质量门至少检查:
- 固定结构、概述长度和故事数量;
- 引用可解析、事实锚点和状态限定;
- 专业对象补充、空泛套话和后台术语;
- 机械的局限、约束、限制、风险或“仍需验证”类结尾;
- 不适合口播的格式。
失败时应保存拒绝原因,并把具体反馈用于下一次尝试。
人工编辑可以修改结构化文稿后单步重跑下游。系统不能把模型输出视为不可更改的最终稿,也不能在模板模式下读取 LLM 凭据或伪造模型元数据。
6.6 EDIT-L1-REQ-006 跨工件内容闭环
| 编号 | 短名 | 主责模块 | 关联模块 |
|---|---|---|---|
| EDIT-L1-REQ-006 | 引用闭环 | PJ2026-020206 引用闭环 | 资讯源、视觉制作、发布运营 |
系统应为每条故事保留:
- 来源标识、来源名称、来源角色和原始链接;
- 中文短释、镜头意图和配音单元;
- 可关联文稿、来源画面、字幕、章节时间轴和评论区引用的故事身份。
引用目录应只列实际采用的来源,不把候选池全部条目混入。发现来源与一手来源并存时必须保持各自角色,不能在引用阶段丢失发现关系或重复计算同一事实。
结构化文稿是下游内容真相源。纯文本配音稿、引用 Markdown 和评论区文本应由它和最终场景时间线生成,不应由人工复制粘贴形成互相漂移的版本。
7. 过程控制
7.1 实现引用契约
- 相关源码文件应标记:
SPEC: PJ2026-0202 编辑策划 draft-2026-07-13-p0。
- 自动生成文件、纯配置、锁文件和二进制工件可以不加文件头:
- 对应生成器、校验器或 owning YAML 入口必须能追溯到本规格。
- 实现状态、源码路径、期次工件和运行证据只进入阶段报告、任务报告、偏离记录或执行 issue。
7.2 原入口验收
- 通过 TypeScript CLI 单步运行
script:- 授权 LLM 路径应记录模型、请求和用量工件;
--template-only路径应不读取 LLM 凭据。
- 核对开场期数、栏目名、日期、五十字内概述、卡片大纲和固定转场句。
- 核对每条故事的事实锚点、来源角色、状态限定、专业对象补充和未知信息边界。
- 核对引用可在期次来源清单中解析,配音单元和故事顺序一致。
- 通过人工朗读抽检口语节奏、信息密度、“AI 味”套话和机械限制型结尾。
7.3 质量门和人工覆盖
- 被质量门拒绝的模型响应必须保留请求级用量、拒绝原因和重试关系。
- 达到最大重试仍失败时应输出明确阻塞,不得自动降低事实或引用要求。
- 人工改稿后重跑下游时,应保留新的作业和工件哈希,不覆盖已发布版本的证据。
- 提示词、受众熟悉对象、禁用表达、目标长度或状态规则变化时,先改 owning YAML;涉及稳定完成标准时同步更新本规格。