Shisa株式会社(总部:东京都港区,以下简称“Shisa AI”)宣布正式推出基于自主研发 AI 模型的实时语音识别 API。
该 API 兼具高语音识别准确率与超低延迟响应,可应用于实时会议转写、呼叫中心、直播等对即时响应能力有较高要求的多种服务场景。同时,所有数据处理均在日本境内的服务器及基础设施上完成,满足企业对数据安全的要求。
Shisa AI 推出的实时语音识别 API “shisa-realtime-asr”,在日本语音识别基准测试 SPREDS 中取得了 5.0% 的字符错误率(CER)。按量计费价格为每小时 0.45 美元;月度承诺使用量达到 2,000 小时,价格为每小时 0.40 美元;达到 10,000 小时,价格为每小时 0.36 美元;50,000 小时以上则根据具体需求单独报价。
引擎处理延迟约为 38.6 毫秒。在使用多样化的 10 秒语音样本进行的 100 次以上测试中,从说话结束到最终结果确认的时间,在单连接情况下约为 254 毫秒;在 10 路并发连接情况下约为 499 毫秒。以上准确率及延迟数据为 Shisa AI 在测试环境中的测量结果,仅供参考。引擎处理时间与从说话结束到最终结果确认的时间属于不同指标,实际响应时间可能因使用条件而有所不同。
包括语音数据在内的所有数据处理,均在日本境内的服务器及基础设施上完成。这有助于降低企业对于数据跨境传输的顾虑,也为具有严格数据安全要求的企业及组织提供更便于评估和导入的环境。
本 API 采用清晰、透明的价格体系。详情请参阅[价格页面](https://platform.shisa.ai/ja/#pricing)。
Shisa AI 拥有位于日本的自主 AI 研发团队。用户及企业反馈可以直接反映到模型开发中,并持续进行模型更新,以更好地应对日语特有的表达方式、敬语、方言以及文化语境等语言特征。此外,Shisa AI 还可在服务导入过程中提供技术支持,并根据企业具体需求快速进行定制化开发。
除了标准日语外,API 还支持包括关西腔在内的地方方言,为日语环境提供针对性优化的语音识别能力。未来,Shisa AI 还计划增加东北方言、九州方言等不同地区方言的支持。API 还提供自定义词库功能,用户可以提前注册企业名称、产品名称、人名、专业术语以及行业特有表达等词汇。
Shisa Real-time ASR API 于 2026 年 9 月 1 日开始提供服务。价格为每小时 0.45 美元起,支持日语和英语。详情请参阅[服务页面](https://platform.shisa.ai/ja/solutions/asr),或通过 contact@shisa.ai 联系我们。
Shisa株式会社致力于开发针对日语和英语进行优化的开放模型,以及翻译和语音 API。Shisa AI 重视日语特有的语境、敬语以及文化语境等语言特征,并致力于为日本企业和开发者提供易于实际应用的 AI 模型与服务。
Shisa AI 官方网站:https://shisa.ai/ja/<br>Shisa AI 官方 X:https://x.com/shisa_ai<br>Shisa AI 官方 Facebook:[https://www.facebook.com/Shisa.Inc](https://www.facebook.com/Shisa.Inc)<br>Shisa AI 官方 LinkedIn:https://jp.linkedin.com/company/shisa-ai
更多新闻
Shisa V2 系列正式发布:新一代双语大语言模型
推出我们最新的双语 LLM 系列,在日语处理能力方面实现了重大突破。
阅读全文Shisa V2.1 系列正式发布:支持从端侧到云端的全场景应用
推出更轻量、更智能的 LLM 系列,显著提升了日语处理能力与效率。
阅读全文