面向区域语种语音 AI 训练的双人真实对话语料采集与质检
ASR
Praat
Audacity
WAV
Diarization
正在基于该需求推演落地方案…
需求痛点(公开)
训练对话式 ASR 及语音交互模型时,团队严重匮乏马来语等区域性语言的真实日常对话数据;公开语料大多为朗读录音或新闻播报,缺失自然交互中的抢话重叠、语流变化和母语口音,且跨国协调母语者按特定声学标准(如低底噪、特定采样率)采集音频的管理成本极高。
切入方向(公开)
提供一站式母语对话者招募与录音工程交付方案,引导母语者围绕指定场景进行半即兴对谈,交付符合声学规范的双轨无损 WAV 音频(48kHz/24-bit、底噪低于 -45dB),并配套精确的话轮切分时间戳与信噪比质检报告。
下方分析是尚待编辑复核的 AI 假设,分数与投入判断不代表已验证的推荐。
发布预算不代表已成交或付款;任务数量不等于独立买家数量,也不能证明订阅意愿。小样本仅作为初步线索。
原始需求溯源 · 2 条
"Paid opportunity for native Malay speakers who are fluent in spoken English: take part in a relaxed, natural two-person conversation recording for AI…"
"I’m assembling a corpus of real-life Malay dialogue that will be used to train AI models, and I need"
仅展示任务摘要与外链,不转载原文全文;个人信息已脱敏。数据来源已登记,可溯源。
💬 社区讨论