用来从视频音频生成 SRT 字幕,并把字幕翻译成其他语言
主要功能:
直接放入视频,生成 SRT 字幕。
语音识别使用 whisper.cpp,模型按需下载,不需要手动配置 Python。
翻译可以使用本地 Hy-MT2 模型,API key 不是必需项。
也可以接入 DeepL、OpenAI、Gemini 等在线翻译。
对长视频和非英语视频,提供 large-v2 Sync 和 Sync Lite,用来修正普通模型可能出现的字幕时间漂移。
OpenDroid:🤖 适用于 Android 的开源 AI 代理,一款生产就绪的、可自我规划的 AI 助手,由本地/远程 LLM 和辅助功能驱动的屏幕自动化提供支持
OpenDroid 不仅仅是另一个聊天机器人。它是一个完全自主的人工智能代理,可以安装在你的安卓手机上,并实际为你完成一些事情。
https://github.com/yashab-cyber/opendroid
OpenDroid 不仅仅是另一个聊天机器人。它是一个完全自主的人工智能代理,可以安装在你的安卓手机上,并实际为你完成一些事情。
https://github.com/yashab-cyber/opendroid
Gemini 蒸馏服务支持教师模型训练学生模型
Gemini 蒸馏服务可利用较大教师模型的回答和推理,训练更小的学生模型,以降低延迟和费用。优享先机期间支持 gemini-3.1-pro 作为教师模型、gemini-2.5-flash 作为学生模型。
服务要求项目加入许可名单、在 us-central1 区域运行,数据集须为存储在 Cloud Storage 的 JSONL 提示集;仅支持文本输入。
Google Cloud Documentation
🌸 科技圈· 茶馆 · 投稿
Gemini 蒸馏服务可利用较大教师模型的回答和推理,训练更小的学生模型,以降低延迟和费用。优享先机期间支持 gemini-3.1-pro 作为教师模型、gemini-2.5-flash 作为学生模型。
服务要求项目加入许可名单、在 us-central1 区域运行,数据集须为存储在 Cloud Storage 的 JSONL 提示集;仅支持文本输入。
Google Cloud Documentation
🌸 科技圈· 茶馆 · 投稿