一站式智能语音能力开放平台

把语音智能,装进你的每一台设备

实时语音识别 ASR、语音合成 TTS、大模型对话 LLM 三大核心能力,硬件厂商与开发者只需更改 API 地址,即可为产品赋予听得懂、说得出的 AI 能力。

// 一行接入,无需内置 Key
ws://ac.uuai.cc/v1/asr/stream
auth: Device-Key xxxxxxxx
→ 实时返回识别文本
model: 2pass (流式 · 增量返回)
← 同时返回 TTS 语音流
智能音箱 / 车机 / 工牌
用户说:打开客厅的灯
ASR:打开客厅的灯
TTS:好的,已为您打开
< 200ms
端到端延迟
100k+
单集群并发
99.95%
服务可用性
50万+
累计接入设备
核心能力

三大能力,覆盖语音交互全链路

从听到说、再到理解——开箱即用的语音 AI 基础设施,一次接入全部打通。

实时语音识别 ASR

FunASR 流式引擎,毫秒级增量返回;支持 2pass / 在线 / 离线多种识别模式。

中文 / 多语种 · 热词定制 · 标点恢复

语音合成 TTS

多音色、多情感,低延迟流式合成;支持自定义音库与语速、语调精细调节。

多种音色 · 情感韵律 · 流式播报

大模型对话 LLM

动态路由 Qwen / DeepSeek / Gemma 等主流模型,完全兼容 OpenAI 协议。

意图理解 · Function Call · 多模型路由
应用场景

一句话接入,落地四大语音场景

无论是设备播报、跨语言沟通,还是全双工对话、录音转写,都能快速集成上线。

语音播报

设备状态、告警与通知即时合成语音播报,无需预置音频文件。

语音翻译

中英日韩等多语种实时互译,边说边译,适配会议与跨语言沟通。

实时语音对话

全双工实时语音对话,边说边听、随时打断,交互自然流畅。

语音转写

录音、会议与文件音频转写加摘要,支持按时间戳输出文本。

开发者友好

改一行地址,剩下的交给我们

无需重构固件、无需内置 Key。把请求指向我们的网关,即可按项目配置自动调度最优后端资源。

传统集成
语音识别
Endpoint: ws://openai.com/v1/audio
Model: whisper-1
文本对话
Endpoint: https://api.openai.com/v1
Auth: 需要每台设备内置 API Key
我们的系统
实时 ASR 流式中枢
Endpoint: ws://ac.uuai.cc/v1/asr/stream
Modes: 2pass / Online / Offline
对话模型 (LLM) 动态映射
Endpoint: /v1/chat/completions
Model: gemma3 / Qwen / DeepSeek...
商业化能力

开箱即用的商业闭环,专心卖设备

授权、计费、结算、报表一站式内置,你只管把好产品卖出去。

一机一码锁定

基于硬件指纹绑定,防止 Key 被多台设备共享,保护核心商业利益。

自动计费结算

集成支付宝 / 微信支付,自动生成 Key 发货,用量多退少补。

灵活收费模式

买断、包月、按量付费自由组合,按项目灵活配置授权与额度。

用量与报表

实时用量、余额与账单报表,欠款台账清晰,方便对账与运营。

准备好让你的设备开口说话了吗?

立即注册,5 分钟完成第一台设备接入,免费额度即开即用。

免费开始接入