OPEN SOURCE · v0.1.0

转写不应该只剩下
一段来路不明的文字。

YW Transcribe 先锁定隐私、能力和费用边界,再执行识别、保留原始证据、生成字幕,最后用确定性校验器判断是否真正完成。

3
条确定性后端路由
0
默认云端上传
52+
自动化回归测试
RUN / 001 DONE
BACKENDlocal / large-v3
PROFILEtimed
PRIVACYlocal only
ARTIFACTSTXT · JSON · SRT · VTT
VALIDATIONPASS

SHA-256  8f2c…a19d

默认本地。没有明确授权,不上传。

能力不匹配,就在上传前停止。

校验没有通过,就不声称完成。

ROUTING / 01

不是三个供应商,
而是三种明确能力。

路由由用户要的产物和隐私边界决定,不由品牌偏好决定。

01

PRIVATE BY DEFAULT

Local

Apple Silicon 上的 MLX Whisper。音频留在本机,支持原生时间轴与字幕。

  • 默认路由,不需要 API Key
  • small / large-v3 自动选型
  • TXT、SRT、VTT 与逐词时间
02

TEXT ECONOMY

StepFun

明确授权后的云端纯文本路径。全球站和中国站固定端点,不跨区重试。

  • StepAudio 2.5 ASR
  • 支持任务级热词
  • 不伪造 SRT 或时间轴
03

CLOUD TIMELINE

Doubao

需要云端分句时间或字幕时使用。提交与查询状态持久化,避免盲目重提。

  • Seed ASR 2.0
  • 原生分句时间
  • SRT / VTT 可验证交付

ARCHITECTURE / 02

从意图到证据,
每一步都有可检查的交接物。

A

Control

路由、授权、费用和重试边界。

B

Artifacts

manifest、run、raw、字幕和审阅状态。

C

Evidence

哈希、质量指标与 validation 结论。

ONBOARDING / 03

复制一句话,
从下一轮对话开始。

安装后上传文件,Skill 会先检查环境;缺什么,就按当前系统给出下一步。

Codex
请从 https://github.com/yuwen-cool/yw-transcribe/tree/main/skills/yw-transcribe 安装 yw-transcribe Skill。
  1. 01安装使用上面的 GitHub 路径。
  2. 02新一轮对话上传本地音频或视频。
  3. 03说出边界“本地优先;云端前先告诉我。”
  4. 04跟随 doctor完成依赖或 API Key 配置。

EVIDENCE / 04

样本结果公开,
结论边界也公开。

数据用于说明被测路径,不被包装成通用质量排名。

large-v3 · clean

0CER

large-v3 · technical

0CER

small · clean

1.32%CER

small · technical

2.86%CER

YW TRANSCRIBE

让文字可用,
也让结果可信。

在 GitHub 查看 开始配置