VPS 只做调度、预算保护和结果记录,不下载视频、不做本地 OCR。限免模型会被标记为风险项,后续任务执行前按价格/预算自动跳过或降级。
| 优先级 | 任务 | Provider | 模型 | Key | 状态 | 风险 | 说明 |
|---|---|---|---|---|---|---|---|
| 10 | ocr | siliconflow | PaddlePaddle/PaddleOCR-VL-1.5 | 已配置 | 可用 | 低风险 | 课件/截图 OCR 首选;实测抽取最全,适合先读图中文字。 |
| 20 | ocr | siliconflow | deepseek-ai/DeepSeek-OCR | 已配置 | 可用 | 限免 | 限免 OCR 候选;可吃免费红利,但不能作为唯一依赖。 |
| 30 | vision | siliconflow | Qwen/Qwen3-VL-8B-Instruct | 已配置 | 可用 | 低风险 | 关键帧视觉理解首选;实测结构化输出最干净。 |
| 40 | vision | openrouter | nvidia/nemotron-nano-12b-v2-vl:free | 已配置 | 可用 | 限免 | OpenRouter 免费视觉兜底;比 openrouter/free 自动路由更可控。 |
| 50 | youtube_video | gemini | gemini-3.5-flash | 已配置 | 可用 | 限免 | 公开 YouTube URL 优先;预览免费能力可能变化。 |
贴一张可公开访问的课程截图 URL,或直接上传一张本地截图。BiliFlow 会按当前可用 provider 优先级尝试 OCR 或视觉理解。这里不下载视频,只验证少量截图的云端模型链路。
选择一个本地视频,浏览器会在本机抽取少量关键帧,再逐张上传图片给云端 OCR/视觉模型。视频文件本身不会上传到 VPS。