在线咨询
专属客服在线解答,提供专业解决方案
声网 AI 助手
您的专属 AI 伙伴,开启全新搜索体验

行业趋势

RTE图
Convo AI & RTE 2025:当实时互动遇见对话式 AI

2025年10月31日,实时互联网大会(Convo AI & RTE 2025)迎来了第十一届。不同于往年,这一次的大会不只是展示实时音视频的技术进步,而是一次关于“实时互动 × 对话式 AI...

博客封面12
RAG已死?上下文工程和语义层在智能体AI中的崛起

引言 检索增强生成(以下简称RAG)曾经是解决大语言模型(LLM)局限性的革命性方案,但它正在快速演变为更庞大的体系。过去两年企业组织意识到,仅靠向量搜索检索文本片段已远远不够。上下文必须具备治理性、...

2025-11-04

博客封面13
对话式 AI + 智能电视:Gemini 带来的语音交互新体验

近日,谷歌正式宣布将 AI 大模型 Gemini 引入 Google TV 平台,使用户可以通过电视进行“自由流式的自然语言对话”。这一举措意味着电视这个传统家庭娱乐中心将成为全新的对话式 AI 入口...

AI塔罗在线聊天体验怎么样?对话体验、技术原理全面解析

随着人工智能的发展,“AI塔罗”这一新兴对话应用正悄然兴起。许多年轻人开始尝试通过在线聊天与AI塔罗进行占卜,对比传统塔罗占卜,这种对话式AI带来了全新的体验。那么,AI塔罗的在线聊天体验究竟怎么样?...

2025-09-02

语音人工智能 Voice AI 详解六:​智能打断、低延迟与降噪处理

在上一部分我们了解了语音 AI Agent 搭建方案。这一篇将聚焦于其中的关键技术实现:如何让语音代理更加智能地处理打断,如何优化延迟达到实时效果,以及如何进行降噪和回声消除来提升语音交互质量。这些问...

2025-08-22

语音人工智能 Voice AI 详解五:搭建语音AI Agent流程(无代码+自主开发方案)

语音 AI Agent(智能语音助手)正日益成为人机交互的重要形式。它可以模拟人类通过语音进行对话,为用户提供实时的服务和信息。在本篇文章中,我们将面向开发者详细介绍构建第一个 Voice AI Ag...

2025-08-20

多语言语音AI:NVIDIA Granary开源语音数据集详解

Granary 是 NVIDIA 于 2025 年8月推出的超大规模开源语音数据集,汇集了约 100 万小时的语音音频,覆盖25种欧洲语言。它是迄今最大规模的多语言语音数据资源之一,包括约65万小时的...

2025-08-20

多语言语音AI之一:多语言语音AI技术模型盘点

全球约有 7000 种语言,而现有 AI 语言模型覆盖的仅是极小一部分。过去,主流语音识别和语音助手大多专注于英语、中文等少数几种主要语言,许多中小语言的使用者在与智能设备交互时不得不借助第二语言。如...

2025-08-19

1 2 3