基于神经语音合成的 EPUB 电子书批量转有声书流水线
ElevenLabs API
Python
EPUB
FFmpeg
正在基于该需求推演落地方案…
需求痛点(公开)
拥有多部电子书的出版者若依赖网页端逐章复制粘贴,不仅效率低下,还难以在 ElevenLabs 等高拟真语音引擎中精准预估字符配额消耗,更缺乏统一的多书目批量处理与分章导出机制。
切入方向(公开)
构建端到端批量处理脚本,自动解析 EPUB 目录并按自然停顿结合 ElevenLabs Multilingual v2 的单次字符上限进行智能切片,配合 API 额度监控与断点重试,最终统一拼接并输出带分章标签的 MP3 或 M4B 有声书成品。
下方分析是尚待编辑复核的 AI 假设,分数与投入判断不代表已验证的推荐。
发布预算不代表已成交或付款;任务数量不等于独立买家数量,也不能证明订阅意愿。小样本仅作为初步线索。
原始需求溯源 · 2 条
"Convert 10 EPUB ebooks into audio books using ElevenLabs "Brian" narrators voice. They must be converted using the Eleven Multilingual v2 generation…"
"I have ten short EPUB titles (total size 17 961 KB) that I want read aloud with ElevenLabs’ “Brian” voice using the Eleven Multilingual v2 engine.…"
仅展示任务摘要与外链,不转载原文全文;个人信息已脱敏。数据来源已登记,可溯源。
💬 社区讨论