ai.doge.tg 繁體 AI 情報 最新 專案 搜尋 Telegram ↗

Nari Labs 推出基於 Qwen3 的語音模型 TTS / ASR,主打低延遲與低成本公測

工具 1 個來源 · 8 天前
為何重要

- 對於開發者而言,這類專注於語音推理最佳化的服務降低了高品質即時語音互動的技術門檻,避免企業自建基礎設施的成本。 - 這反映了 AI 基礎設施細分化趨勢,專攻特定模態(如多模態語音)的推理廠商正試圖在效率和可控性上擊敗通用的 Cloud API。

  • 研究公司 Nari Labs 發布基於 Qwen3 模型的語音合成(Nari Qwen3-TTS)與語音辨識(Nari Qwen3-ASR)服務,主打高準確度的多模態推理。
  • 在效能基準上,其服務在單張 H100 GPU 上可達到 10 RPS 且 p95 time-to-first-audio 低於 50 ms。
  • 服務提供免費公測,價格分別為 $10 / 1M characters(Fast 端點)與 $0.12 / hour(Standard 端點)。
Nari LabsQwen3TTSASRInferenceH100

來源 · 1 篇報導

首發 Hacker News Front Page narilabs.com 00:07