feedback-investigation

反馈排查工具功能说明与实施规划

从一条用户反馈出发,串联业务知识、平台查询与目标版本源码,交付能复核的解释、证据和下一步。

独立 Agent Skill只读调查定位效果待验证状态截至 2026.09.16
Skill 已生成,下一步是补齐证据并验证效果。

历史分析、方向与平台梳理、独立 Skill 生成及首轮真实试查已发生。最新历史成果仍待增量接入;平台收录、协议测试通过与真实根因定位,需要分别验收。

14业务方向卡
10 / 28平台卡 / 能力定义
13 / 13协议测试通过 · 非效果分数
01

工具定位

把分散的信息组织成可以检验的调查,而不只生成解释。

给出一条用户反馈,或者一组 VOC 反馈,Agent 按业务方向整理现象、选择平台、追查变更与代码机制,最终输出可以复核的结论、证据和下一步。反馈排查工具希望减少的,是人工在反馈、实验、配置、日志和代码之间反复搬运上下文的工作。

本文介绍的已生成实现名为 feedback-investigation。它是供 Agent 加载的独立 Skill,复用 bytedcli、lark-cli、已授权平台页面和本地源码能力。它已经生成,并完成协议测试、平台只读探查及首轮真实案例使用;仍需补齐目标现场取证与常用业务映射,验证实际定位效果。

用户反馈通常只描述结果:短剧播放卡顿、横屏显示不全、登录后本地书消失。定位时却要回答一连串不同的问题:发生在什么系统和版本?影响一人还是一批人?有没有实验、配置或发布变化?哪个请求、对象或代码分支能解释现象?目标用户是否真的经过了这条路径?

这些信息分散在不同平台,平台中的 AppID、空间、时间口径和权限也不统一。直接把平台结果交给模型,容易得到看似合理却缺少现场依据的解释。历史上查过类似问题,也只能告诉我们去哪里查,不能证明新反馈有相同根因。

工具围绕三个场景组织能力:

  • 单条深查:还原一个用户的完整操作过程,沿日志、请求、对象状态和目标版本源码寻找原因。
  • 批量归因:先按症状、系统、版本和时间分类,再选择代表反馈深查,说明结论能覆盖哪些条目。
  • 异常趋势分析:核对反馈基线、版本规模和线上变化,判断哪些解释值得继续取证。
02

历史分析与知识来源

统计范围与 Skill 已接入范围分开计算。

历史分析已经产出可读报告。打开 历史反馈统计与平台链接报告(本地资料),可以按票号、平台、域名、参数和上下文检索。它覆盖固定的 2026 年 3—8 月研究名单,不是实时反馈库。

口径 已有结果 使用方式
历史统计范围 625 条反馈、619 个关联群 用于理解问题分布与排查路径,不等于该时期所有线上反馈
内容覆盖 616 条有实质内容;排除明确工具测试后的内容分母为 599 条 无内容不代表没有问题;未标测试的记录也未必都是真实用户反馈
历史解释 493 条有解释 包含人工确认、推测和自动候选,不等于 493 条根因已证实
平台链接整理 550 条反馈找到链接;4,117 条票号—URL 记录,其中 2,613 条带显式参数 帮助找到入口及参数;不是执行次数或查询成功率
当前 Skill 已吸收的知识 早期 315 条已接纳投影所提炼的方向方法与证据规则 指导当前调查;不是最新 625 条资料已全部接入的证明

9 月 7 日的内容报告复用了 301 条既有材料并补读其他记录;没有重新读取所有旧材料和附件。9 月 15 日的链接报告中,2,907 条仍是同群候选,10 条已标记属于其他票,链接未逐个在线验证。因此,链接存在、人工使用平台和实际取到结果应分别判断。

两套数量描述不同成果:625 条是后续统计范围,315 条是当前 Skill 声明的历史知识来源。现有 Skill 尚未发现对 9 月 7 日内容报告及 9 月 15 日链接索引的明确接入引用,后续应提取其中新增的方法与平台知识;无需把原有 Skill 重新生成一遍。

内容补读口径:复用 301 条既有材料,补读 324 条;625 条中 616 条有实质内容,9 条没有实质内容。历史统计不作为正式测评答案。

03

能力结构与平台覆盖

知道去哪里查,不代表已拥有目标资源的查询权限。

组成 已实现内容 承担的工作
调查入口与流程 Skill 入口、单条/批量流程、证据标准 理解反馈、选择模式、建立假设、消费平台结果、形成结论
业务方向知识 14 张方向卡及方向配置契约 指引不同业务的对象、常见路径和取证入口;具体平台映射按任务验证
平台能力知识 10 张平台卡、28 项能力定义 说明何时查、需要什么参数、如何读取、结果能证明什么
调查记录 标准库 Python 脚本、JSON Schema 记录计划、工具尝试、证据引用和终态,校验事件顺序与哈希链
报告输出 单条和批量报告模板 保留用户路径、结论、证据、反证、范围、工具使用与未决项

业务判断由调查 Agent 负责,脚本负责记录和检查执行事实。脚本通过不意味着归因正确,仍需审查来源是否支持结论。

14 个方向包括 UG、商业化、多元变现、番茄社区、小说内容分发、其他/新体裁、账号、书架、听书、客户端与其他、阅读器,以及短剧分发、消费和社区。方向卡已具备导航内容;不能据此宣称 14 个方向都已完成真实根因定位验证。

平台路径与使用边界

下表描述已收录的路径。平台实测记录主要来自 2026-09-02,权限与接口状态应在使用时重新检查。

调查问题 主要平台 当前能力与边界
原始反馈、标签、范围与趋势 VOC、TICKET、Feedback Agent VOC 镜像 VOC 有 UI 与部分 CLI 成功读取记录;分享解析、扩展字段和 TICKET CLI 仍有缺口;镜像需核对同步水位
实验与配置变化 Libra、Settings、TCC 已整理只读入口和部分真实查询;用户命中、资源权限和生效时间需单独绑定
人群、行为与播放质量 TEA、NVQoS 已验证部分 TEA 聚合;NVQoS 空间目录可读不等于目标数据集有权
设备、请求与服务现场 Slardar、Log、BytedTrace、AnywhereDoor 有部分趋势、调用树及设备目录成功记录;现场仍依赖精确身份、请求、对象和时间
源码、版本与资源交付 Git、Codebase、Bits、Release Manager、Gecko 可查询源码及发布路径;目标 build 到 revision 的映射仍需闭合
短剧可见度与播控 Amon、lvideo.control 已确认入口和查询契约;此前业务读取受角色/RPC 权限阻塞
账号、对象与数据链路 UCenter、ABase、Kylin、Dolphin、Hive、Aeolus、Dorado 已收录能力与绑定要求,部分只验证到元数据或契约层
复用已有调查 Feedback Agent 任务和产物 API 已整理安全 GET 路径;旧模型结论属于报告引用,不能自动充当当前直接证据

这些平台按问题按需调用。28 项能力定义不是 28 个平台全部可用,也不意味着所有查询都已有权限。

04

调查流程与证据标准

先还原用户现场,再判断什么证据能够改变结论。

还原反馈和范围

从完整反馈中提取操作、受影响对象、时间、产品、系统、客户端版本和实际结果。Android、iOS、HarmonyOS 分别绑定源码、日志、发布和配置;系统未知或来源冲突时保留缺口,不根据产品名称推断系统。

批量输入需要核对筛选条件、分页、总量和时间范围。看到页面总数或少量可见条目,只能说明批次规模和初步画像,不能算全量分类完成。

建立假设,选择下一步

围绕四类问题展开调查:

证据轴 主要问题
基线 问题是否异常增加,集中在哪些人群、版本和时段?
变更 实验、Settings/TCC、服务发布或动态资源是否改变了行为?
代码 目标版本的哪条调用链、状态变化或分支能产生该现象?
用户与环境 内容、账号、设备、系统、网络或特定操作是否构成触发条件?

Agent 优先执行能确认、反驳或明显改变假设排序的有限查询。失败后区分认证、权限、映射、数据保留期与返回契约问题,再决定是否有可用的下一条路径。

版本峰值、相近时间或同名实验只提供线索。真正的归因需要把线上条件、源码消费和用户可见结果接起来。

记录证据,判断是否定位

每个工具尝试记录“要回答什么、实际返回什么、如何改变判断”。中断或仍在等待的操作不能被写成已经取得的证据。历史报告、平台提及和直接读取结果分别标记。查询保留平台用途、安全的关键输入、时间范围、结果引用及其对判断的影响。历史链接中的参数名可帮助理解接口,具体 UID/DID、内容、实验或 LogID 应绑定到当前授权反馈;令牌、签名和 Cookie 不进入普通报告。

调查结果 含义
已定位 located 当前反馈的现象、机制和目标现场命中都有成功闭合的直接证据
证据不足收口 exhausted 当前授权与可用来源不能闭合剩余假设,保留最强解释、已尝试路径和缺口
已取消 cancelled 用户或所属流程终止调查,保留已有成果和停止原因

“源码中存在相关分支”通常只证明机制可能存在。还需要证据说明目标用户、设备、请求或对象在问题时间确实经过该机制,才达到定位标准。

批量共因外推必须基于已经定位的代表案例,记录被外推条目及适用条件。代表案例证据不足时,仍可报告共同症状和候选解释,不能给整批反馈确认根因。

05

如何使用

项目内存在 Skill,不等于已全局安装或上线。

在支持 Skill 发现的宿主中,使用 feedback-investigation 描述排查意图;实际命令入口以宿主加载结果为准。当前文件位于项目的 skills/custom/,文件存在不代表已经全局安装或接入线上 Runner。

单条示例:

使用 feedback-investigation 排查这条反馈:<反馈链接>。
关注用户的完整操作过程、系统和客户端版本;
在现有授权范围内只读调查,输出最强结论、证据和剩余缺口。

批量示例:

使用 feedback-investigation 分析这组反馈:<VOC 分享或明确筛选>。
先核对范围并按症状、系统、版本分类,再选择代表问题深查。
最终说明逐条查到了什么,哪些条目仍未取证。

如果宿主未发现该 Skill,可以明确要求读取并遵循本地 SKILL.md(本地资料)。

Agent 先整理输入、业务方向、反馈范围、证据来源和竞争假设。范围与授权已明确时复用既有约定;信息会影响排查方向或访问范围时,再集中补齐。执行时根据证据调整下一步,最终提供单条报告或批量汇总及代表案例报告。

身份、时间或日志不足时仍能返回有依据的部分结果,但不会保证每条反馈都能定位,也没有固定耗时或成功率承诺。

06

当前进度与完成边界

文档整合不重新执行平台查询,也不更新历史验收日期。

状态核对日期:2026-09-16。平台在线状态以 2026-09-02 的实施记录为主,未在这次文档整理中重新请求全部平台。

阶段 当前状态 有效产物与完成边界
历史数据分析 已完成固定样本的轻量内容统计 625 条名单、616 条有内容、599 条排除明确测试后的内容分母;不代表全量根因闭环
调研报告与平台梳理 已有报告和链接索引 9 月 15 日报告可检索 625 条及平台链接;候选归属和未在线验证边界明确
独立 Skill 生成 已完成,已接入早期 315 条投影的方法 入口、14 张方向卡、10 张平台卡、28 项能力定义、配置契约、脚本、Schema、报告模板
最新历史知识增量接入 待差异整理与验证 当前 Skill 明确来源仍为 315 条投影;未发现对最新内容/链接报告的接入引用
协议验证 已完成并部分复验 13 项单测于 2026-09-16 重跑通过;结构、Schema、编译等在原实施记录中有通过记录
真实案例验证 已做首轮,效果验证未完成 3 个 VOC 批次和 3 个代表案例,历史终态均为 exhausted;未证明成功定位及完整批量外推
稳定使用与试运行 待推进 需要固定 Skill 装载方式、业务映射、现场证据路径和长期产物
独立测评集 暂缓 目录中的行为样例与协议测试不能等同于正式测评集及效果成绩
生产接入、回写与回收 后续候选 独立设计、授权和验证,不计入当前 Skill 完成度

历史手册已经在当前目录的“调研”子目录找到。原 /private/tmp/feedback-research-phase2 交接位置和 /private/tmp/feedback-investigation-live-20260902 报告位置已失效。当前可核对 Skill 文件、历史交接副本和仓库实施记录;不把缺失的旧轨迹标成今天可重放。

首轮试查带来的改进

已试查三组反馈,选取两条 Android 和一条 iOS 代表反馈。发现的问题已回写 Skill:

  • VOC 分析分享可能是批次;分享解析为空与缺少扩展字段需要分别处理,浏览器重写 ID 只作导航。
  • NVQoS 空间可见不代表数据集可读;权限阻塞不能解释成没有异常。
  • Libra 同 key 可能跨产品,严格版本边界及实验审计时间会改变判断。
  • Codebase 查询需限制仓库、路径和语言;当前源码不能代替目标 build 对应 revision。

六条历史轨迹均未完成现场因果闭环。当前记录没有证明对 2,733、38、37 条反馈做过完整逐条分型,也没有 HarmonyOS 代表案例。因此,本阶段只能认定为首轮试查完成,完整效果验证仍在后续。

当前默认只读。自动修复、改配置、部署、回写 VOC / 工单、发群消息和自动采纳回收均不属于已交付能力。独立 Skill、服务化 Feedback Agent 和另一套 feedback-troubleshoot 的实现与验收不能混算。

当前 Skill 在本地项目中存在,目录受 Git 忽略规则管理;尚不能由此推断已经提交、全局安装或发布给团队。默认轨迹存储已有持久路径,后续调查需要实际使用,并把正式报告移出临时目录。

07

实施规划

保留已有成果,沿关键证据缺口推进,不从头重做。

步骤 01

历史数据分析

固定样本轻量统计完成

步骤 02

报告与平台梳理

报告、平台卡和能力索引已有

步骤 03

生成独立 Skill

入口、知识、脚本与模板已生成

步骤 04

首轮真实试查

已使用,成功定位效果仍待验证

步骤 09

按需扩展

测评、服务接入、采纳与知识更新

这是逻辑依赖顺序,不是对历史执行先后的重写:骨架与记录协议先完成,随后接入获授权的历史材料;平台验证也曾提前开展。步骤五至九是后续安排,不代表已实施。

5

补入历史知识增量,整理本地交付与业务配置

待推进

目的:复用已生成 Skill,吸收新增资料的价值,使后续调查能加载正确方法、选择对应产品/系统并保留可追溯产物。

先读哪些资料

入口 用途
最新 HTML 报告(本地资料) 浏览问题、原因、平台用途与候选路径
内容统计说明(本地资料)、链接整理说明(本地资料) 核对分母、覆盖范围与未验证部分
含链接的逐票简表(本地资料) 需要时按具体案例读取,避免整表进入上下文
链接索引(本地资料)、来源覆盖(本地资料) 核对链接归属、参数及来源,筛除他票材料
当前 Skill 引用目录(本地资料) 确认已有方法及实际加载路径,只补有价值的差异

如何补入

从首轮案例相关的短剧消费、书架及通用实验/配置路径开始,挑选有判别价值的历史材料。短方法记录适用症状、竞争解释、首个检查、必需参数及来源、支持/反驳信号、停止条件、限制与历史来源。单例知识限定范围,多例仍需检查反例。

把通用差异写回已有方向卡和平台卡;只有确有独立用途时新增短方法文件,并从入口或方向卡明确何时读取。平台输入说明保留“用途—入口—参数名及来源—CLI 路径—限制”,URL 字段含义未经证实则标未知。历史对象标识不能直接套用到新反馈。

产物:一份文件级差异清单、更新后的知识引用及来源。完成标准:从新反馈的意图能找到相应方法、参数来源和查询入口;仅新增文件或复制历史报告不算接入完成。

同时整理使用交付

项目 具体动作 产物 完成标准
装载与版本 明确实际使用宿主、Skill 入口和源码版本;确认项目装载是否成功 使用说明、可识别的版本标记 从自然语言请求能加载正确 Skill,未混入另一套方案
常用映射 从已有可信来源整理产品 × OS 的 VOC、日志、实验、配置、仓库与发布映射 经过验证的方向配置 每个 ID 有来源、核对时间与状态;未知值明确保留
长期记录 使用脚本已有持久存储,指定正式报告路径;盘点旧链接 可恢复任务目录及报告索引 新任务中断后能读回计划、结果和开放尝试;报告可打开
历史留存 查找正式备份,找不到的旧材料只保留历史摘要 可用/缺失来源清单 失效临时路径不再充当当前证据

此步骤无需重新开发调查框架。涉及全局安装、发布或更换宿主时,按具体变更另行确认。

6

优先打通能改变结论的取证路径

待推进

优先级依据首轮真实案例暴露的缺口,动态平台状态在执行时重验。

优先级 工作 具体输入与动作 完成标准
P0 VOC 稳定输入与完整批次 使用新鲜授权分享/反馈,核对完整内容、分页、总量、OS/version/build;验证已记录的降级路径 能枚举目标范围,说明缺失字段,不能把可见页当全量
P0 目标现场取证 从当前反馈的时间、设备、对象或请求出发,读取可用日志、请求响应和 LogID 至少能取得与目标操作绑定的直接材料;不可用时明确原因与保留期
P0 build 到源码映射 核验发布记录、repo、tag/commit、系统和 source set 可说明被调查用户运行的代码版本,或给出具体映射缺口
P1 Libra 历史命中与配置消费 绑定产品、OS、build、身份、时间,区分实验定义、历史命中和代码消费 命中与不命中的判断有时间及过滤依据
P1 NVQoS 播放质量 确认目标空间、数据集及已有权限,再查匹配产品/版本/时间的指标 得到可解释的聚合结果或明确 ACL 阻塞;不依赖目录可见性推断
P1 Amon 短剧播控 在已有权限下绑定 album、目标端、时间和只读 RPC 能读取目标播控状态;解释当前快照与历史状态差别
P2 长尾对象/审核/数据来源 按真实案例需要绑定对象,再启用 ABase、Kylin、Dolphin 等 平台结果回答了具体业务问题,而不止列出元数据

目标用户标识只能来自当前授权反馈或受保护来源。需要权限、原始日志或设备采证时,明确所需资源与范围。平台没有数据或权限不足,应交付缺口,不反复执行等价查询。

7

用新鲜真实案例验证闭环

待推进

目的:验证“会不会查、查得对不对”,而不仅是记录脚本是否通过。

建议按已有证据可获得性选择小批案例:Android 和 iOS 各覆盖一个高价值问题;补充有明确目标配置和现场材料的 HarmonyOS 案例;保留一个权限不足或数据过期案例;再选择一组大小可控的批量反馈验证完整分类。

逐例执行:

  1. 固定原始输入、产品、OS、版本、发生时间和权限条件。
  2. 重建完整操作过程,建立竞争假设。
  3. 调用相关平台并保留直接材料引用,检查是否还有可能改变结论的来源。
  4. 把现场行为与目标源码/服务机制关联,明确下游结果和最强替代解释。
  5. 输出报告并由另一位具备上下文的审阅者核对事实、因果与范围。
  6. 将通用问题修回 Skill;个案证据留在任务目录,复跑受影响路径。

完成标准包括:有真实定位案例能闭合现象、机制和现场;证据不足案例能保留有效结果并正确停止;批量能说明全部条目的处理范围;各系统不互借证据。若本轮没有可定位案例,仍可交付调查结果,但必须保持“成功定位效果未验证”。

若需要判断新增历史知识是否改善调查,可选择少量案例,在同模型、同输入、同权限及数据条件下对照接入前后结果;条件不同只记录观察,不声明效果提升。优先看关键证据、遗漏的反证与结论正确性,不比较报告字数或查询次数。

这是小规模试运行验证,沿用“独立测评集暂缓”的决定,不扩展为正式测评工程。

8

小范围试运行并形成稳定版本

待推进

输入是步骤五至七确认的支持范围和案例结果。优先选择已经具备完整映射与权限的方向,不追求同时覆盖全部 14 个方向。

记录每次任务的调查结论、权限/输入缺口、人工介入、查询量、耗时和错误归因。统计时保留分母及输入条件,区分可定位案例、证据不足案例和工具失败,不以提高 located 比例为目标压低标准。

产物是一份稳定使用说明、支持范围矩阵和试运行问题清单。完成标准是他人可以按说明复现入口、获得可读报告,并清楚知道哪些能力依赖权限或外部输入。此时再决定版本分发方式及是否扩大业务范围。

9

按需求评估后续扩展

按需启动
方向 需要新增的工作 启动条件
正式测评 建立独立样本、答案与证据标准,评估误归因、证据不足判停和跨系统路由 用户决定恢复测评建设,且已有足够可核验样本
Feedback Agent 接入 明确 Runner 如何装载、等待并消费 Skill 结果,验证源材料和报告流转 单独接入设计与测试,不能把本地 Skill 存在当成线上接入
采纳回收 区分采纳、部分采纳、不采纳与后续事实修正,关联原调查版本 有明确回收对象和写入授权;报告中的采纳占位不算已实现闭环
持续知识更新 将已复核共性方法写成短知识单元,检查反例和适用范围 知识有来源和版本,不将个案根因直接写成通用规则
修复或回写 对接代码修复、工单、VOC 或通知 明确动作、目标与权限,独立验证副作用

历史交接列出的生产阻断项包括知识正文版本绑定、召回截断、独立语义评估、真实 loader/callsite 以及固定 Runner 工具验证。这些属于交接时的历史检查项;如未来决定接入,需要对当前实现重新核验,不直接认定它们今天仍未解决,也不由文档推断已经解决。

建议下一轮范围

先对照最新历史报告补入有价值的知识增量,完成持久交付与常用产品/OS 映射,再围绕 VOC 完整输入、目标日志/请求和 build 对应源码三条 P0 路径开展新鲜案例验证。NVQoS、Amon 和长尾平台按具体问题的证据价值穿插推进。

新增平台数量暂不作为主要进度指标。更重要的是:针对一条明确反馈,工具是否知道去哪里查、能否读到目标事实、这些事实是否足以改变结论。

08

资料依据与维护

可追溯来源;原始报告和逐票数据不随单页打包。

合并来源:反馈排查工具介绍与功能说明、反馈排查工具执行步骤与后续规划。保留原文状态日期与证据边界;本地资料以名称列出,不生成在其他设备上失效的本机路径链接。

  • 参考文档:安卓自动化测试修复验证:借鉴介绍顺序,不继承其真机操作、自动修复或耗时承诺。
  • 历史数据交接(本地资料):已接入的 315 条历史投影与知识使用边界。
  • 9 月 7 日内容统计说明(本地资料)、9 月 15 日平台链接说明(本地资料):后续 625 条轻量统计及链接整理口径。
  • Skill 入口(本地资料)、平台能力矩阵(本地资料)。
  • 实施记录(本地资料)、设计文档(本地资料)。
  • 方向配置契约:feedback-investigation/references/direction-config.md(本地资料)。
  • 补充核对:含链接逐票简表、链接索引与来源覆盖文件,均来自 2026-09-15 平台链接整理成果(本地资料)。

进度根据可核对产物和实际执行记录更新。平台动态权限与接口在使用时复验;新增目标、生产接入、外部写入与公开分享分别确认。网页中的“不索引”标记不是访问控制。