发布时间:2026/8/22 21:11:04
一行代码,把任意音频变成多语言LRC字幕文件 一行代码把任意音频变成多语言LRC字幕文件【免费下载链接】openlrcTranscribe and translate voice into LRC file using Whisper and LLMs (GPT, Claude, et,al). 使用whisper和LLM(GPTClaude等)来转录、翻译你的音频为字幕文件。项目地址: https://gitcode.com/gh_mirrors/op/openlrc录完音想做LRC字幕以前得逐句对时间戳、敲文字、再翻译校对比录音本身还费劲。OpenLRC 是个开源工具本地做音频转录再用 LLM 翻译一次调用产出可直接使用的 LRC 字幕文件。 它帮你省掉什么1小时的转录从手写变成等几分钟以前给1小时的播客做中文字幕得边听边打字时间戳全靠估错别字还得逐行修。 用它之后faster-whisper 负责转录VAD 自动跳过静音段直接得到带逐段时间戳的文字不需要手工对齐。逐行机翻到上下文连贯的完整字幕以前逐行机翻的句子生硬割裂专有名词前后翻译不一致。 用它之后LLM 先通读全篇转录稿归纳出术语、语气、目标受众的翻译准则再按准则逐句翻译还可以传入术语表锁定关键词译法。一个一个来到批量跑以前视频要先手动抽音频文件逐个处理队列排不完。 用它之后一次传入路径列表转录串行、翻译并行执行视频文件直接产出 .srt不用额外转格式。⚙️ 底层逻辑速览音视频先经 ffmpeg 抽出音频faster-whisper 完成语音识别第一个 LLM 通读全文生成翻译准则第二个再按准则逐句翻译最后写入 .lrc 或 .srt。转录全程本地运行只有翻译走云端 API。转录核心在 openlrc/transcribe.py字幕对齐与写入逻辑在 openlrc/subtitle.py。 最小上手路径首次使用需要 Python 3.10~3.12装好 ffmpeg并配置好一个 LLM API key环境变量如OPENAI_API_KEY。安装命令只需一次pip install openlrc。from openlrc import LRCer lrcer LRCer() lrcer.run(./podcast.mp3, target_langzh-cn)跑完会在音频同目录生成podcast.lrc。想试用最新特性可以先 clone 仓库https://gitcode.com/gh_mirrors/op/openlrc再pip install .本地安装。进阶用法批量音频转字幕只需把路径放进列表bilingual_subTrue输出原文加译文的双语字幕fee_limit限制单条音频的翻译花费from openlrc import LRCer from openlrc.config import TranslationConfig lrcer LRCer(translationTranslationConfig(fee_limit1.0)) lrcer.run([a.mp3, b.mp4], target_langzh-cn, bilingual_subTrue)环境嘈杂的录音可加noise_suppressTrue降噪需先安装完整版依赖追加full扩展。 实战场景英文歌曲 → 中文LRC。手机播放器里喜欢的英文歌只有 Karaoke 式歌词。把 mp3 传给lrcer.run()得到的 LRC 文件可以导入任何播放器歌词随音乐逐行滚动。不碰终端也能跑。仓库自带网页界面拖入音频选 Whisper 模型和目标语言勾选双语字幕点 GO。执行streamlit run openlrc/gui_streamlit/home.py需已安装 streamlit即可打开。❓ 卡点速查支持什么格式MP3、WAV、FLAC、M4A 等音频视频文件也可以直接给内部用 ffmpeg 抽音频。音频输入生成 .lrc视频输入生成 .srt。转录出现幻觉静音段乱码预处理默认做了响度归一化来抑制这类问题录音环境吵就开noise_suppressTrue需先装完整版依赖。没有显卡能跑吗把 TranscriptionConfig 的 device 改成cpu就能运行速度会慢一些。翻译要花钱吗转录完全本地执行只有翻译调用 LLM API。用便宜模型一小时音频大约 0.01 美元设fee_limit超支自动停止也可用 lean 模式省 token。OpenLRC 把转录、翻译、写字幕压成了一次 API 调用本地转录部分零成本。从LRCer().run()开始今天就能做出第一份 LRC 字幕。【免费下载链接】openlrcTranscribe and translate voice into LRC file using Whisper and LLMs (GPT, Claude, et,al). 使用whisper和LLM(GPTClaude等)来转录、翻译你的音频为字幕文件。项目地址: https://gitcode.com/gh_mirrors/op/openlrc创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

相关新闻

2026/8/22 21:11:04

用Alloy形式化建模LLVM IR并发内存模型:提升编译器正确性的新方法

这次我们来看一个面向编译器开发者和形式化验证研究者的技术提案:使用 Alloy 形式化语言对 LLVM IR 的并发内存模型进行建模。这个 pre-RFC 讨论的核心不是发布一个即插即用的工具,而是探讨一种用精确的数学模型来定义和验证 LLVM 中间表示层并发语义的可…

2026/8/22 21:11:04

5 步跑通 Windows 硬件指纹伪装:从驱动加载到驱动卸载

5 步跑通 Windows 硬件指纹伪装:从驱动加载到驱动卸载 【免费下载链接】EASY-HWID-SPOOFER 基于内核模式的硬件信息欺骗工具 项目地址: https://gitcode.com/gh_mirrors/ea/EASY-HWID-SPOOFER EASY-HWID-SPOOFER 是一个 Windows 内核级硬件指纹伪装工具&…

2026/8/22 22:21:10

培训排课系统实战指南:从需求分析到算法落地的完整方案

培训排课系统实战指南:从需求分析到算法落地的完整方案 培训排课是教育机构、企业内部培训以及各类技能认证中心核心的日常运营场景。与简单的预约系统相比,排课系统面临更复杂的资源约束:教室容量、讲师时间、学员班级、课程连续性以及可能的…

2026/8/22 22:16:09

09-Git 仓库蒸馏术:从代码仓库到 OpenClaw 虚拟人-知识图谱构建

09 知识图谱构建:连接知识节点这是《Git 仓库蒸馏术:从代码仓库到 OpenClaw 虚拟人》系列的第 9 篇。前几篇我们蒸馏出了各种"碎片":仓库画像、演进报告、架构文档、知识摘要、模式库、决策记录。这一篇把这些碎片织成一张网——知…

2026/8/21 13:13:49

工业通信系统底层逻辑:04 反射——高频能量撞墙之后会发生什么?

第四篇:反射——高频能量撞墙之后会发生什么? —— 你以为信号已经过去了,其实它正在回来打你 老Q的现场笔记 第五季,我们正式进入工业神经系统层。这里不再是单个设备的战斗,而是整个工厂“经脉”层面的秩序之战。从这一篇开始,你将第一次看清:看似简单的信号传播,背…

2026/8/21 20:14:07

工业传感器与变送器详解:序章 从物理世界到工业数据

序章 从物理世界到工业数据 ——重新认识工业传感器与变送器 工业自动化系统正变得日益复杂。今天的工业现场早已不是简单的控制回路,而是由多层技术共同构成的立体体系:PLC、DCS、SCADA、MES、工业互联网、边缘计算与人工智能。控制系统可以执行复杂算法,工业网络可以实现…

2026/8/21 15:40:01

实测才敢推 AI论文网站 2026最新测评与推荐

2026年真正好用的AI论文网站,核心看生成的论文质量、低AI味、格式正确、学术适配四大指标。综合实测,千笔AI、ThouPen、豆包、DeepSeek、Grammarly 是当前最值得推荐的梯队,覆盖从免费到付费、从中文到英文、从文科到理工的全场景需求。一、综…

2026/8/21 15:40:01

2026必备!AI论文网站测评:最新推荐与深度对比

2026年真正好用的AI论文网站,核心看生成的论文质量、低AI味、格式正确、学术适配四大指标。综合实测,千笔AI、ThouPen、豆包、DeepSeek、Grammarly 是当前最值得推荐的梯队,覆盖从免费到付费、从中文到英文、从文科到理工的全场景需求。 一、…

2026/8/22 1:39:53

摆脱论文困扰!盘点2026年全网爆红的的AI论文写作工具

一天写完毕业论文在2026年已不再是天方夜谭。2026年最炸裂、实测能大幅提速的AI论文写作工具,覆盖选题构思、文献整理、内容生成、格式排版等核心场景,真正帮你高效搞定论文难题。 一、全流程王者:一站式搞定论文全链路(一天定稿首…