feedback-investigation
反馈排查工具功能说明与实施规划
从一条用户反馈出发,串联业务知识、平台查询与目标版本源码,交付能复核的解释、证据和下一步。
独立 Agent Skill只读调查定位效果待验证状态截至 2026.09.16
Skill 已生成,下一步是补齐证据并验证效果。历史分析、方向与平台梳理、独立 Skill 生成及首轮真实试查已发生。最新历史成果仍待增量接入;平台收录、协议测试通过与真实根因定位,需要分别验收。
14业务方向卡
10 / 28平台卡 / 能力定义
13 / 13协议测试通过 · 非效果分数
01工具定位
把分散的信息组织成可以检验的调查,而不只生成解释。
给出一条用户反馈,或者一组 VOC 反馈,Agent 按业务方向整理现象、选择平台、追查变更与代码机制,最终输出可以复核的结论、证据和下一步。反馈排查工具希望减少的,是人工在反馈、实验、配置、日志和代码之间反复搬运上下文的工作。
本文介绍的已生成实现名为 feedback-investigation。它是供 Agent 加载的独立 Skill,复用 bytedcli、lark-cli、已授权平台页面和本地源码能力。它已经生成,并完成协议测试、平台只读探查及首轮真实案例使用;仍需补齐目标现场取证与常用业务映射,验证实际定位效果。
用户反馈通常只描述结果:短剧播放卡顿、横屏显示不全、登录后本地书消失。定位时却要回答一连串不同的问题:发生在什么系统和版本?影响一人还是一批人?有没有实验、配置或发布变化?哪个请求、对象或代码分支能解释现象?目标用户是否真的经过了这条路径?
这些信息分散在不同平台,平台中的 AppID、空间、时间口径和权限也不统一。直接把平台结果交给模型,容易得到看似合理却缺少现场依据的解释。历史上查过类似问题,也只能告诉我们去哪里查,不能证明新反馈有相同根因。
工具围绕三个场景组织能力:
- 单条深查:还原一个用户的完整操作过程,沿日志、请求、对象状态和目标版本源码寻找原因。
- 批量归因:先按症状、系统、版本和时间分类,再选择代表反馈深查,说明结论能覆盖哪些条目。
- 异常趋势分析:核对反馈基线、版本规模和线上变化,判断哪些解释值得继续取证。
02历史分析与知识来源
统计范围与 Skill 已接入范围分开计算。
历史分析已经产出可读报告。打开 历史反馈统计与平台链接报告(本地资料),可以按票号、平台、域名、参数和上下文检索。它覆盖固定的 2026 年 3—8 月研究名单,不是实时反馈库。
| 口径 |
已有结果 |
使用方式 |
| 历史统计范围 |
625 条反馈、619 个关联群 |
用于理解问题分布与排查路径,不等于该时期所有线上反馈 |
| 内容覆盖 |
616 条有实质内容;排除明确工具测试后的内容分母为 599 条 |
无内容不代表没有问题;未标测试的记录也未必都是真实用户反馈 |
| 历史解释 |
493 条有解释 |
包含人工确认、推测和自动候选,不等于 493 条根因已证实 |
| 平台链接整理 |
550 条反馈找到链接;4,117 条票号—URL 记录,其中 2,613 条带显式参数 |
帮助找到入口及参数;不是执行次数或查询成功率 |
| 当前 Skill 已吸收的知识 |
早期 315 条已接纳投影所提炼的方向方法与证据规则 |
指导当前调查;不是最新 625 条资料已全部接入的证明 |
9 月 7 日的内容报告复用了 301 条既有材料并补读其他记录;没有重新读取所有旧材料和附件。9 月 15 日的链接报告中,2,907 条仍是同群候选,10 条已标记属于其他票,链接未逐个在线验证。因此,链接存在、人工使用平台和实际取到结果应分别判断。
两套数量描述不同成果:625 条是后续统计范围,315 条是当前 Skill 声明的历史知识来源。现有 Skill 尚未发现对 9 月 7 日内容报告及 9 月 15 日链接索引的明确接入引用,后续应提取其中新增的方法与平台知识;无需把原有 Skill 重新生成一遍。
内容补读口径:复用 301 条既有材料,补读 324 条;625 条中 616 条有实质内容,9 条没有实质内容。历史统计不作为正式测评答案。
03能力结构与平台覆盖
知道去哪里查,不代表已拥有目标资源的查询权限。
| 组成 |
已实现内容 |
承担的工作 |
| 调查入口与流程 |
Skill 入口、单条/批量流程、证据标准 |
理解反馈、选择模式、建立假设、消费平台结果、形成结论 |
| 业务方向知识 |
14 张方向卡及方向配置契约 |
指引不同业务的对象、常见路径和取证入口;具体平台映射按任务验证 |
| 平台能力知识 |
10 张平台卡、28 项能力定义 |
说明何时查、需要什么参数、如何读取、结果能证明什么 |
| 调查记录 |
标准库 Python 脚本、JSON Schema |
记录计划、工具尝试、证据引用和终态,校验事件顺序与哈希链 |
| 报告输出 |
单条和批量报告模板 |
保留用户路径、结论、证据、反证、范围、工具使用与未决项 |
业务判断由调查 Agent 负责,脚本负责记录和检查执行事实。脚本通过不意味着归因正确,仍需审查来源是否支持结论。
14 个方向包括 UG、商业化、多元变现、番茄社区、小说内容分发、其他/新体裁、账号、书架、听书、客户端与其他、阅读器,以及短剧分发、消费和社区。方向卡已具备导航内容;不能据此宣称 14 个方向都已完成真实根因定位验证。
平台路径与使用边界
下表描述已收录的路径。平台实测记录主要来自 2026-09-02,权限与接口状态应在使用时重新检查。
| 调查问题 |
主要平台 |
当前能力与边界 |
| 原始反馈、标签、范围与趋势 |
VOC、TICKET、Feedback Agent VOC 镜像 |
VOC 有 UI 与部分 CLI 成功读取记录;分享解析、扩展字段和 TICKET CLI 仍有缺口;镜像需核对同步水位 |
| 实验与配置变化 |
Libra、Settings、TCC |
已整理只读入口和部分真实查询;用户命中、资源权限和生效时间需单独绑定 |
| 人群、行为与播放质量 |
TEA、NVQoS |
已验证部分 TEA 聚合;NVQoS 空间目录可读不等于目标数据集有权 |
| 设备、请求与服务现场 |
Slardar、Log、BytedTrace、AnywhereDoor |
有部分趋势、调用树及设备目录成功记录;现场仍依赖精确身份、请求、对象和时间 |
| 源码、版本与资源交付 |
Git、Codebase、Bits、Release Manager、Gecko |
可查询源码及发布路径;目标 build 到 revision 的映射仍需闭合 |
| 短剧可见度与播控 |
Amon、lvideo.control |
已确认入口和查询契约;此前业务读取受角色/RPC 权限阻塞 |
| 账号、对象与数据链路 |
UCenter、ABase、Kylin、Dolphin、Hive、Aeolus、Dorado |
已收录能力与绑定要求,部分只验证到元数据或契约层 |
| 复用已有调查 |
Feedback Agent 任务和产物 API |
已整理安全 GET 路径;旧模型结论属于报告引用,不能自动充当当前直接证据 |
这些平台按问题按需调用。28 项能力定义不是 28 个平台全部可用,也不意味着所有查询都已有权限。
04调查流程与证据标准
先还原用户现场,再判断什么证据能够改变结论。
还原反馈和范围
从完整反馈中提取操作、受影响对象、时间、产品、系统、客户端版本和实际结果。Android、iOS、HarmonyOS 分别绑定源码、日志、发布和配置;系统未知或来源冲突时保留缺口,不根据产品名称推断系统。
批量输入需要核对筛选条件、分页、总量和时间范围。看到页面总数或少量可见条目,只能说明批次规模和初步画像,不能算全量分类完成。
建立假设,选择下一步
围绕四类问题展开调查:
| 证据轴 |
主要问题 |
| 基线 |
问题是否异常增加,集中在哪些人群、版本和时段? |
| 变更 |
实验、Settings/TCC、服务发布或动态资源是否改变了行为? |
| 代码 |
目标版本的哪条调用链、状态变化或分支能产生该现象? |
| 用户与环境 |
内容、账号、设备、系统、网络或特定操作是否构成触发条件? |
Agent 优先执行能确认、反驳或明显改变假设排序的有限查询。失败后区分认证、权限、映射、数据保留期与返回契约问题,再决定是否有可用的下一条路径。
版本峰值、相近时间或同名实验只提供线索。真正的归因需要把线上条件、源码消费和用户可见结果接起来。
记录证据,判断是否定位
每个工具尝试记录“要回答什么、实际返回什么、如何改变判断”。中断或仍在等待的操作不能被写成已经取得的证据。历史报告、平台提及和直接读取结果分别标记。查询保留平台用途、安全的关键输入、时间范围、结果引用及其对判断的影响。历史链接中的参数名可帮助理解接口,具体 UID/DID、内容、实验或 LogID 应绑定到当前授权反馈;令牌、签名和 Cookie 不进入普通报告。
| 调查结果 |
含义 |
已定位 located |
当前反馈的现象、机制和目标现场命中都有成功闭合的直接证据 |
证据不足收口 exhausted |
当前授权与可用来源不能闭合剩余假设,保留最强解释、已尝试路径和缺口 |
已取消 cancelled |
用户或所属流程终止调查,保留已有成果和停止原因 |
“源码中存在相关分支”通常只证明机制可能存在。还需要证据说明目标用户、设备、请求或对象在问题时间确实经过该机制,才达到定位标准。
批量共因外推必须基于已经定位的代表案例,记录被外推条目及适用条件。代表案例证据不足时,仍可报告共同症状和候选解释,不能给整批反馈确认根因。
05如何使用
项目内存在 Skill,不等于已全局安装或上线。
在支持 Skill 发现的宿主中,使用 feedback-investigation 描述排查意图;实际命令入口以宿主加载结果为准。当前文件位于项目的 skills/custom/,文件存在不代表已经全局安装或接入线上 Runner。
单条示例:
使用 feedback-investigation 排查这条反馈:<反馈链接>。
关注用户的完整操作过程、系统和客户端版本;
在现有授权范围内只读调查,输出最强结论、证据和剩余缺口。
批量示例:
使用 feedback-investigation 分析这组反馈:<VOC 分享或明确筛选>。
先核对范围并按症状、系统、版本分类,再选择代表问题深查。
最终说明逐条查到了什么,哪些条目仍未取证。
如果宿主未发现该 Skill,可以明确要求读取并遵循本地 SKILL.md(本地资料)。
Agent 先整理输入、业务方向、反馈范围、证据来源和竞争假设。范围与授权已明确时复用既有约定;信息会影响排查方向或访问范围时,再集中补齐。执行时根据证据调整下一步,最终提供单条报告或批量汇总及代表案例报告。
身份、时间或日志不足时仍能返回有依据的部分结果,但不会保证每条反馈都能定位,也没有固定耗时或成功率承诺。
06当前进度与完成边界
文档整合不重新执行平台查询,也不更新历史验收日期。
状态核对日期:2026-09-16。平台在线状态以 2026-09-02 的实施记录为主,未在这次文档整理中重新请求全部平台。
| 阶段 |
当前状态 |
有效产物与完成边界 |
| 历史数据分析 |
已完成固定样本的轻量内容统计 |
625 条名单、616 条有内容、599 条排除明确测试后的内容分母;不代表全量根因闭环 |
| 调研报告与平台梳理 |
已有报告和链接索引 |
9 月 15 日报告可检索 625 条及平台链接;候选归属和未在线验证边界明确 |
| 独立 Skill 生成 |
已完成,已接入早期 315 条投影的方法 |
入口、14 张方向卡、10 张平台卡、28 项能力定义、配置契约、脚本、Schema、报告模板 |
| 最新历史知识增量接入 |
待差异整理与验证 |
当前 Skill 明确来源仍为 315 条投影;未发现对最新内容/链接报告的接入引用 |
| 协议验证 |
已完成并部分复验 |
13 项单测于 2026-09-16 重跑通过;结构、Schema、编译等在原实施记录中有通过记录 |
| 真实案例验证 |
已做首轮,效果验证未完成 |
3 个 VOC 批次和 3 个代表案例,历史终态均为 exhausted;未证明成功定位及完整批量外推 |
| 稳定使用与试运行 |
待推进 |
需要固定 Skill 装载方式、业务映射、现场证据路径和长期产物 |
| 独立测评集 |
暂缓 |
目录中的行为样例与协议测试不能等同于正式测评集及效果成绩 |
| 生产接入、回写与回收 |
后续候选 |
独立设计、授权和验证,不计入当前 Skill 完成度 |
历史手册已经在当前目录的“调研”子目录找到。原 /private/tmp/feedback-research-phase2 交接位置和 /private/tmp/feedback-investigation-live-20260902 报告位置已失效。当前可核对 Skill 文件、历史交接副本和仓库实施记录;不把缺失的旧轨迹标成今天可重放。
首轮试查带来的改进
已试查三组反馈,选取两条 Android 和一条 iOS 代表反馈。发现的问题已回写 Skill:
- VOC 分析分享可能是批次;分享解析为空与缺少扩展字段需要分别处理,浏览器重写 ID 只作导航。
- NVQoS 空间可见不代表数据集可读;权限阻塞不能解释成没有异常。
- Libra 同 key 可能跨产品,严格版本边界及实验审计时间会改变判断。
- Codebase 查询需限制仓库、路径和语言;当前源码不能代替目标 build 对应 revision。
六条历史轨迹均未完成现场因果闭环。当前记录没有证明对 2,733、38、37 条反馈做过完整逐条分型,也没有 HarmonyOS 代表案例。因此,本阶段只能认定为首轮试查完成,完整效果验证仍在后续。
当前默认只读。自动修复、改配置、部署、回写 VOC / 工单、发群消息和自动采纳回收均不属于已交付能力。独立 Skill、服务化 Feedback Agent 和另一套 feedback-troubleshoot 的实现与验收不能混算。
当前 Skill 在本地项目中存在,目录受 Git 忽略规则管理;尚不能由此推断已经提交、全局安装或发布给团队。默认轨迹存储已有持久路径,后续调查需要实际使用,并把正式报告移出临时目录。
07实施规划
保留已有成果,沿关键证据缺口推进,不从头重做。
步骤 02报告与平台梳理
报告、平台卡和能力索引已有
步骤 03生成独立 Skill
入口、知识、脚本与模板已生成
步骤 04首轮真实试查
已使用,成功定位效果仍待验证
步骤 05增量与使用交付
接入新增方法,明确装载与映射
步骤 06关键平台取证
完整输入、现场证据、目标源码
步骤 07新鲜案例验证
单条、批量、多系统与合理判停
步骤 08小范围试运行
形成支持矩阵,观察质量与成本
这是逻辑依赖顺序,不是对历史执行先后的重写:骨架与记录协议先完成,随后接入获授权的历史材料;平台验证也曾提前开展。步骤五至九是后续安排,不代表已实施。
5
补入历史知识增量,整理本地交付与业务配置
待推进目的:复用已生成 Skill,吸收新增资料的价值,使后续调查能加载正确方法、选择对应产品/系统并保留可追溯产物。
先读哪些资料
| 入口 |
用途 |
| 最新 HTML 报告(本地资料) |
浏览问题、原因、平台用途与候选路径 |
| 内容统计说明(本地资料)、链接整理说明(本地资料) |
核对分母、覆盖范围与未验证部分 |
| 含链接的逐票简表(本地资料) |
需要时按具体案例读取,避免整表进入上下文 |
| 链接索引(本地资料)、来源覆盖(本地资料) |
核对链接归属、参数及来源,筛除他票材料 |
| 当前 Skill 引用目录(本地资料) |
确认已有方法及实际加载路径,只补有价值的差异 |
如何补入
从首轮案例相关的短剧消费、书架及通用实验/配置路径开始,挑选有判别价值的历史材料。短方法记录适用症状、竞争解释、首个检查、必需参数及来源、支持/反驳信号、停止条件、限制与历史来源。单例知识限定范围,多例仍需检查反例。
把通用差异写回已有方向卡和平台卡;只有确有独立用途时新增短方法文件,并从入口或方向卡明确何时读取。平台输入说明保留“用途—入口—参数名及来源—CLI 路径—限制”,URL 字段含义未经证实则标未知。历史对象标识不能直接套用到新反馈。
产物:一份文件级差异清单、更新后的知识引用及来源。完成标准:从新反馈的意图能找到相应方法、参数来源和查询入口;仅新增文件或复制历史报告不算接入完成。
同时整理使用交付
| 项目 |
具体动作 |
产物 |
完成标准 |
| 装载与版本 |
明确实际使用宿主、Skill 入口和源码版本;确认项目装载是否成功 |
使用说明、可识别的版本标记 |
从自然语言请求能加载正确 Skill,未混入另一套方案 |
| 常用映射 |
从已有可信来源整理产品 × OS 的 VOC、日志、实验、配置、仓库与发布映射 |
经过验证的方向配置 |
每个 ID 有来源、核对时间与状态;未知值明确保留 |
| 长期记录 |
使用脚本已有持久存储,指定正式报告路径;盘点旧链接 |
可恢复任务目录及报告索引 |
新任务中断后能读回计划、结果和开放尝试;报告可打开 |
| 历史留存 |
查找正式备份,找不到的旧材料只保留历史摘要 |
可用/缺失来源清单 |
失效临时路径不再充当当前证据 |
此步骤无需重新开发调查框架。涉及全局安装、发布或更换宿主时,按具体变更另行确认。
6
优先打通能改变结论的取证路径
待推进优先级依据首轮真实案例暴露的缺口,动态平台状态在执行时重验。
| 优先级 |
工作 |
具体输入与动作 |
完成标准 |
| P0 |
VOC 稳定输入与完整批次 |
使用新鲜授权分享/反馈,核对完整内容、分页、总量、OS/version/build;验证已记录的降级路径 |
能枚举目标范围,说明缺失字段,不能把可见页当全量 |
| P0 |
目标现场取证 |
从当前反馈的时间、设备、对象或请求出发,读取可用日志、请求响应和 LogID |
至少能取得与目标操作绑定的直接材料;不可用时明确原因与保留期 |
| P0 |
build 到源码映射 |
核验发布记录、repo、tag/commit、系统和 source set |
可说明被调查用户运行的代码版本,或给出具体映射缺口 |
| P1 |
Libra 历史命中与配置消费 |
绑定产品、OS、build、身份、时间,区分实验定义、历史命中和代码消费 |
命中与不命中的判断有时间及过滤依据 |
| P1 |
NVQoS 播放质量 |
确认目标空间、数据集及已有权限,再查匹配产品/版本/时间的指标 |
得到可解释的聚合结果或明确 ACL 阻塞;不依赖目录可见性推断 |
| P1 |
Amon 短剧播控 |
在已有权限下绑定 album、目标端、时间和只读 RPC |
能读取目标播控状态;解释当前快照与历史状态差别 |
| P2 |
长尾对象/审核/数据来源 |
按真实案例需要绑定对象,再启用 ABase、Kylin、Dolphin 等 |
平台结果回答了具体业务问题,而不止列出元数据 |
目标用户标识只能来自当前授权反馈或受保护来源。需要权限、原始日志或设备采证时,明确所需资源与范围。平台没有数据或权限不足,应交付缺口,不反复执行等价查询。
7
用新鲜真实案例验证闭环
待推进目的:验证“会不会查、查得对不对”,而不仅是记录脚本是否通过。
建议按已有证据可获得性选择小批案例:Android 和 iOS 各覆盖一个高价值问题;补充有明确目标配置和现场材料的 HarmonyOS 案例;保留一个权限不足或数据过期案例;再选择一组大小可控的批量反馈验证完整分类。
逐例执行:
- 固定原始输入、产品、OS、版本、发生时间和权限条件。
- 重建完整操作过程,建立竞争假设。
- 调用相关平台并保留直接材料引用,检查是否还有可能改变结论的来源。
- 把现场行为与目标源码/服务机制关联,明确下游结果和最强替代解释。
- 输出报告并由另一位具备上下文的审阅者核对事实、因果与范围。
- 将通用问题修回 Skill;个案证据留在任务目录,复跑受影响路径。
完成标准包括:有真实定位案例能闭合现象、机制和现场;证据不足案例能保留有效结果并正确停止;批量能说明全部条目的处理范围;各系统不互借证据。若本轮没有可定位案例,仍可交付调查结果,但必须保持“成功定位效果未验证”。
若需要判断新增历史知识是否改善调查,可选择少量案例,在同模型、同输入、同权限及数据条件下对照接入前后结果;条件不同只记录观察,不声明效果提升。优先看关键证据、遗漏的反证与结论正确性,不比较报告字数或查询次数。
这是小规模试运行验证,沿用“独立测评集暂缓”的决定,不扩展为正式测评工程。
8
小范围试运行并形成稳定版本
待推进输入是步骤五至七确认的支持范围和案例结果。优先选择已经具备完整映射与权限的方向,不追求同时覆盖全部 14 个方向。
记录每次任务的调查结论、权限/输入缺口、人工介入、查询量、耗时和错误归因。统计时保留分母及输入条件,区分可定位案例、证据不足案例和工具失败,不以提高 located 比例为目标压低标准。
产物是一份稳定使用说明、支持范围矩阵和试运行问题清单。完成标准是他人可以按说明复现入口、获得可读报告,并清楚知道哪些能力依赖权限或外部输入。此时再决定版本分发方式及是否扩大业务范围。
9
按需求评估后续扩展
按需启动
| 方向 |
需要新增的工作 |
启动条件 |
| 正式测评 |
建立独立样本、答案与证据标准,评估误归因、证据不足判停和跨系统路由 |
用户决定恢复测评建设,且已有足够可核验样本 |
| Feedback Agent 接入 |
明确 Runner 如何装载、等待并消费 Skill 结果,验证源材料和报告流转 |
单独接入设计与测试,不能把本地 Skill 存在当成线上接入 |
| 采纳回收 |
区分采纳、部分采纳、不采纳与后续事实修正,关联原调查版本 |
有明确回收对象和写入授权;报告中的采纳占位不算已实现闭环 |
| 持续知识更新 |
将已复核共性方法写成短知识单元,检查反例和适用范围 |
知识有来源和版本,不将个案根因直接写成通用规则 |
| 修复或回写 |
对接代码修复、工单、VOC 或通知 |
明确动作、目标与权限,独立验证副作用 |
历史交接列出的生产阻断项包括知识正文版本绑定、召回截断、独立语义评估、真实 loader/callsite 以及固定 Runner 工具验证。这些属于交接时的历史检查项;如未来决定接入,需要对当前实现重新核验,不直接认定它们今天仍未解决,也不由文档推断已经解决。
建议下一轮范围先对照最新历史报告补入有价值的知识增量,完成持久交付与常用产品/OS 映射,再围绕 VOC 完整输入、目标日志/请求和 build 对应源码三条 P0 路径开展新鲜案例验证。NVQoS、Amon 和长尾平台按具体问题的证据价值穿插推进。
新增平台数量暂不作为主要进度指标。更重要的是:针对一条明确反馈,工具是否知道去哪里查、能否读到目标事实、这些事实是否足以改变结论。
08资料依据与维护
可追溯来源;原始报告和逐票数据不随单页打包。
合并来源:反馈排查工具介绍与功能说明、反馈排查工具执行步骤与后续规划。保留原文状态日期与证据边界;本地资料以名称列出,不生成在其他设备上失效的本机路径链接。
- 参考文档:安卓自动化测试修复验证:借鉴介绍顺序,不继承其真机操作、自动修复或耗时承诺。
- 历史数据交接(本地资料):已接入的 315 条历史投影与知识使用边界。
- 9 月 7 日内容统计说明(本地资料)、9 月 15 日平台链接说明(本地资料):后续 625 条轻量统计及链接整理口径。
- Skill 入口(本地资料)、平台能力矩阵(本地资料)。
- 实施记录(本地资料)、设计文档(本地资料)。
- 方向配置契约:
feedback-investigation/references/direction-config.md(本地资料)。
- 补充核对:含链接逐票简表、链接索引与来源覆盖文件,均来自 2026-09-15 平台链接整理成果(本地资料)。
进度根据可核对产物和实际执行记录更新。平台动态权限与接口在使用时复验;新增目标、生产接入、外部写入与公开分享分别确认。网页中的“不索引”标记不是访问控制。