流声字幕用于在用户主动启用的网页视频页面上生成翻译字幕。
插件可能处理以下数据:
- 当前标签页的网址、标题、页面语言和视频时长。
- 当前标签页中发现的媒体地址,例如 m3u8、mpd、mp4、m4s 或音频地址。
- 为抽取音频所需的有限请求信息,例如来源页面地址、媒体类型和必要的请求头。
- 用户在设置中填写的 ASR/翻译接口地址、模型名称和 API 密钥。
- 用户在任务入口选择的原音频语言。
- 用户在 ASR 档案中选择的 VAD 过滤策略。
- 浏览器内 Web FFmpeg 生成的临时音频切片和 ASR 音频分段。
- 浏览器内 Web FFmpeg 识别出的语音区间元数据,用于跳过无语音分段和过滤静音幻觉。
- 语音识别结果、翻译字幕、用户导入的字幕文件和插件自动缓存的字幕。
- 当前任务的阶段、分段状态和付费请求操作标识,以及语音识别/翻译服务返回的完整响应。FunASR 文件任务还会暂存服务返回的临时文件地址。这些信息用于在浏览器后台重启或消息确认丢失后恢复同一任务,避免重复提交付费请求。
这些数据只用于发现网页视频媒体源、在浏览器内抽取临时音频、调用用户配置的语音识别/翻译服务,以及把生成的字幕显示回当前页面。
- API 密钥保存在本机浏览器的扩展本地存储中,不同步到浏览器账号。
- 字幕缓存保存在本机浏览器的扩展 IndexedDB 中,用于下次打开同一网页链接时直接加载字幕。缓存条目只保存归一化后的页面和媒体身份,不持久化 URL 中的 token、签名或来源追踪参数。插件会自动清理超过 30 天或超过 80 条的旧字幕缓存。
- 用户为
file://本地视频主动选择文件后,Chrome 的 File System Access API 会把该文件的只读句柄和文件名、大小、修改时间保存在扩展本机 IndexedDB 中,供 offscreen 抽取器读取同一个文件,并在任务重试或重新抽取时避免重复选择。插件不会复制文件正文;读取权限由 Chrome 管理,权限失效时会要求用户重新选择。卸载扩展或重置扩展数据会删除这些句柄。 - 音频切片和 ASR 音频分段只作为任务过程数据使用,不作为长期音频归档。插件最多保留约 36 小时,并在音频缓存总量超过约 2 GB 时优先清理已结束任务的数据;用户也可以在侧边栏提前清理。缓存仍完整时可用于继续任务、重试失败分段或重新 ASR;缓存缺失、损坏或已清理时不会继续复用,用户重新抽取后会重新下载或读取原媒体并生成新的音频。普通用户界面不提供额外的音频归档导出入口。
- 语音区间元数据只作为当前任务过程数据使用,不包含转写正文或 API 密钥。
- 任务和分段状态保存在扩展本机 IndexedDB 中;付费请求的完整响应和 FunASR 临时文件地址保存在扩展本机 Cache Storage 中。任务账本只保存模型配置档案引用,不复制 API 密钥。这些数据不会同步到浏览器账号,也不会发送给流声字幕开发者。
- 已完成、失败、取消或中断的任务记录和对应付费响应以 7 天为自动清理期限;浏览器下次运行维护任务时会删除到期数据。清理中断时,插件会保留一份只包含旧任务标识和本地缓存引用的清理记录,在后续维护中继续删除,不会按页面或任务前缀删除新任务的数据。
- 插件申请
unlimitedStorage权限,避免浏览器在存储压力下驱逐仍用于任务恢复和付费响应重放的 IndexedDB/Cache Storage 数据。该权限只影响本机扩展存储;上述自动清理期限和侧边栏音频清理功能仍然有效。 - 插件不会把 API 密钥同步到浏览器账号。
插件不会把数据发送给流声字幕开发者自有服务器。
当用户配置第三方或局域网语音识别、翻译模型时,音频分段、转写文本和待翻译字幕会发送给用户配置的服务地址。
媒体下载可能需要当前网页请求里的有限请求头;这些头只留在后台/offscreen 下载链路中,候选列表不会把 authorization 返回给侧边栏界面。Cookie 不会进入候选或被脚本手写,跨域媒体下载只通过浏览器当前登录态和 credentials: "include" 让浏览器自行附带 Cookie。
插件只向用户配置的服务地址发送该服务需要的请求字段;用户明确选择原音频语言时,会向 ASR 请求写入规范化后的 language 字段。vad_filter 这类非标准 ASR 字段只会发送给 openapi.json 确认支持或用户明确强制开启的兼容接口,不会附加到标准 OpenAI、Groq 或 xAI 请求上。自动模式可能对自建兼容接口读取同源的 openapi.json 能力说明;这不是 ASR 上传请求,也不会对 OpenAI、Groq 或 xAI 执行。
对本地或局域网 OpenAI-compatible ASR,如果同源 openapi.json 明确声明支持 Whisper/faster-whisper 兼容抑制字段,插件可能随 ASR 请求发送这些字段以减少静音、音乐或片尾段幻觉;标准 OpenAI、Groq、xAI 请求不会附加这些非标准字段。
翻译模型如果返回无法解析、整批失败或疑似内容审核错误,插件会先尝试原批量翻译;该批请求失败后,才会把同一翻译批次逐级二分,最多降到单句,尽量救回未触发异常的句子。默认 60 条翻译批次的最坏内容拆分调用预算被测试锁定为不超过 120 次;如果兼容端点首次明确拒绝 response_format,插件会增加 1 次兼容性探测并缓存结果,含该探测的 HTTP 调用预算被测试锁定为不超过 121 次。如果只漏掉部分译文,插件会保留已成功译文并只向用户配置的翻译服务补发缺失项。无效 API key、认证失败、额度、限流和模型不存在等账户或配置错误不会进入切片兜底。部分恢复时,最终仍失败的单句只保留原文和警告,不会写入译文容器;若整段全部翻译失败,则该翻译分段保持 failed 并只保留 source 供重试。用户可在侧边栏明确触发对应翻译分段重翻译;只有浏览器后台仍保留当前任务 ASR 原文时,重翻译才不会重新 ASR。
插件声明全站 host 权限,用于在网页加载早期监听媒体请求并识别 m3u8、mpd、m4s、mp4 或音频源。该权限只用于媒体源发现、字幕挂载和当前页面视频状态读取;插件不会把网页内容发送给流声字幕开发者自有服务器。
插件声明 unlimitedStorage 权限,用于保护任务账本、临时音频和付费响应恢复证据不受普通扩展存储配额或压力驱逐影响。数据只保存在本机,并按前述规则清理。
用户可以把生成好的字幕导出为 SRT 文件,也可以从本地 SRT、VTT、ASS/SSA 或插件导出的 JSON 文件导入字幕。导出的文件由用户自行保存和管理,插件不会把导出文件上传到任何服务器。
卸载扩展或重置浏览器扩展数据会移除浏览器内保存的模型配置、字幕缓存、任务账本、临时音频、付费响应缓存和待完成的本地清理记录。侧边栏也提供清理当前页面字幕缓存和当前任务音频缓存的入口。