数池科技 业务驾驶舱

DATA TURBO BUSINESS DASHBOARD · 对外展示版

2025 — 2026
数据已脱敏处理 · 不含具体金额与个人信息
累计跟进项目
300+
覆盖多语种多模态全场景
已合作项目
95%
合作转化率持续提升
覆盖语种
133+
含中文方言与全球小语种
服务客户
50+
头部科技企业与AI公司
业务类型分布
按项目所属业务领域统计占比
项目状态分布
累计跟进项目的合作状态构成
客户类型分布
按甲方所属行业类型统计
项目周期分布
按项目执行周期长短统计
语种覆盖广度
主要语种与中文方言覆盖情况(项目数)
共覆盖 133 个语种与方言,含中文方言 30+、全球小语种 100+,每个语种项目数为脱敏估算值
2025 vs 2026 业务趋势
各业务类型年度项目量对比
核心能力标签
ASR TTS 多语种翻译 跨文化转译 文本语料采集 大模型语义推理数据训练 动作捕捉 具身智能数据集 灵巧手数据集 UMI+EGO数据采标 指令微调多语种SFT 脑电数据集 多轮医患对话数据集 30+方言数据集 跨境数据标注平台 跨境数据合规能力 多语种语音采集 中文方言识别 高保真语音合成 OCR文字识别 人脸数据采集 3D人脸重建 唇动同步数据 机器臂数据采集 多模态融合
WORLD CORPUS

世界语料库 · 魔耳大模型计划

为大语言模型和物理AI提供「听得见、听得懂全世界」的原生能力,构建全语种、高质量的真实语音交互数据集,让AI听懂世界的每一种语言、感知物理世界的每一个信号。

1000万
总目标 · 小时
全语种
语言覆盖
真实
语音交互数据
100+
国家与地区
PHASE 02
中亚 · 中东
100万小时 高质量语音数据集
第二期构建覆盖中亚、中东地区的高质量语音数据集,打通丝绸之路经济带核心语种与方言覆盖。
PHASE 03
非洲
100万小时 高质量语音数据集
第三期完成覆盖非洲的100万小时高质量语音数据集,覆盖非洲主要语种与地域变体。
PHASE 04
全球其他地区
200万小时 + 多模态图文
第四阶段覆盖其他地区200万小时高质量语音数据集,并同步构建多模态图文数据,实现全语种全模态覆盖。