使用微信扫一扫分享到朋友圈
使用微信扫一扫进入小程序分享活动
赵斌,声网创始人兼CEO。2014年创立声网,开创了全球实时互动云服务。2020年6月26日,声网母公司 Agora, Inc.成功登陆纳斯达克,股票代码 为“API”。声网服务的企业遍布社交、教育、IoT、金融、医疗等20余行业,200多种场景。在此之前,赵斌也曾参与两家美国纳斯达克上市公司的创立。1997年,作为创始工程师之一参与WebEx (网讯) 创业。2007年,作为CTO参与YY (欢聚时代)创业。
Yangqing Jia is the Founder and CEO of Intent Lab and the Founder of Lepton AI, which was acquired by NVIDIA. A renowned AI scientist and entrepreneur, he created Caffe and Caffe2, co-created ONNX, and co-led PyTorch 1.0. He previously served in senior AI roles at NVIDIA, Alibaba, Facebook, and Google Brain and holds a Ph.D. in EECS from UC Berkeley.
毕业于中国人民解放军外国语大学,在教育、文化传媒、人工智能以及实时互动云服务领域有二十余年的行业和管理经验。目前负责统筹商业化、服务、运营侧资源,推动声网业务规模与市场影响力的持续提升。
谢磊,西北工业大学计算机学院教授、博士生导师,音频语音与语言处理实验室(ASLP@NPU)负责人。主要研究方向包括语音处理、对话式人工智能,以及面向语音与语言技术的先进神经网络模型与大模型技术,在语音增强、自动语音识别、语音合成与语音对话等领域开展了系统性研究。他长期致力于建设面向学术界的开源工具与数据资源,指导了被广泛使用的 WeNet 语音识别工具包和 WenetSpeech 开源语音数据系列等项目。他曾获得多项荣誉,包括教育部新世纪优秀人才支持计划、陕西省青年科技新星、全球前2%顶尖科学家(斯坦福大学 & Elsevier)以及华为云 AI 名师等。已发表论文 400 余篇,Google Scholar 引用超过 20000 次。曾获多项国际会议最佳论文奖及国际评测冠军,诸多研究成果已实现产业落地。担任 ISCA SIG-CSLP 副主席、IEEE/ACM TASLP 与 IEEE SPL 的高级领域编委(SAE)。
刘志理 北京冠客科技有限公司 CEO
二十三年营销实战管理经验,曾服务于科龙集团(家电上市公司)、三洋电机(世界500强)、欧迪办公(世界500强上市公司)、芭莎网(礼品行业独角兽)等,担任过大区经理、销售总监等职务。2016年进入机器人行业,精通渠道销售、大客户销售,擅长社会化营销及会议营销等。
张如欢,当前任MiniMax资深AI架构师,拥有10多年AI行业经验,经历Voice Agent 1.0至AIGC时代的技术演进。主导多项创新智能交互AI产品的落地。具备较深厚的技术洞察与商业化能力。
IEEE Fellow,国家千人计划专家,康奈尔大学计算机科学博士,本科毕业于北京大学计算机系,国际数学奥林匹克 IMO 金牌得主。曾担任 AT&T 香农实验室高级研究员、美国德克萨斯大学奥斯汀分校终身副教授,斩获 NSF CAREER Award、ACM SIGMETRICS 时间检验奖等多项国际权威奖项,发表10余篇网络顶会 SIGCOMM 论文,拥有 20 余项美国及国际专利。归国后多次创业,先后落地国内首个网页 P2P 视频方案,打造黑咔相机等亿级用户 AI 视频产品。现任秒瞰科技 CEO,研发无极云实时音视频云。
由声网和 RTE 开发者社区主办的实时互联网大会( RTE 大会)创办于 2015 年,至今已经连续举办十一届。2015 年至今,实时互联网大会从专门面向开发者的技术交流会议,发展为全球音视频领域最具影响力的行业盛会,期间不仅伴随着实时互动行业的成长,还见证了行业从 RTC 实时通讯技术发展到 RTE 实时互动场景 & 产业的爆发。
今年,RTE 大会正式升级为 “ iRTE 实时智能大会”,这是全球首个聚焦“实时智能”的全产业峰会,探讨 RTE 技术如何成为多模态大模型、具身智能、AI Agent 与物理世界交互的“神经系统”,推动 AI 从“云端思考”走向“实时交互”。
对话AGI:实时智能互动的下一章(拟)
赵斌 声网创始人兼 CEO
Models, Automation, and then?(拟)
圆桌1:国际视野+初创
圆桌2:行业落地商业验证
声网Agora最新产品发布、最新动态分享
2026年,企业级对话智能体正从“概念验证”走向规模化落地,应用范围也从智能客服拓展至营销转化、销售外呼、业务办理、用户运营等多元场景。但真正的挑战,已不只是让 AI“听得懂、说得好”,而是让其理解业务、调用工具、完成任务并创造可衡量的价值。
本论坛将汇聚行业技术专家、企业代表与生态伙伴,围绕 Voice Agent 的技术演进、业务闭环、规模化部署与价值衡量,共同探讨企业级客服智能体如何从“能对话”迈向“能办事、能转化、能增长”。
在文字诞生之前,人类通过对话交换情感和思想——充满温度与实时反馈。今天,AI 与实时互动技术正引领一场「对话式社会」复兴,让沟通回归本能。本场论坛,我们将探讨对话式智能体的技术与未来,见证下一代人机交互的诞生。
2025年全球社交应用内购收入达150亿美元,同比增长16%,线上社交与泛娱乐加速全球扩张。实时互动也在持续延伸连接边界,AI成为关键变量,推动社交从人与人互动到人与 Agent 共生。本论坛将围绕在线社交、AI 陪伴与全球化增长等议题,共探社交互动的演进方向与行业增长新路径。
IoT 正加速渗透家居、教育、陪伴等真实场景,AI 与大语言模型则进一步推动智能硬件的品类扩张与能力进化。 本论坛将围绕多模态智能生态,汇聚终端、芯片、模型与开发者,探讨场景落地、业务融合与出海路径,共同关注开源创新与 AI 新终端带来的产业机会。
线上教育正迈入稳定发展与价值深耕的新阶段,用户需求、教学场景与服务模式也在持续演进。AI为内容生产、个性化学习、智能辅导与教学评估注入新动能,实时互动进一步提升线上教学体验。本论坛将围绕AI落地、实时互动及教育模式创新,共探线上教育的新突破与增长空间。
超低延迟的实时 AI 是实现人机交互无缝融入日常生活的关键。从推理加速、流式模型设计,到高并发调度,都对底层设施提出了极限挑战。本专场将剖析实时 AI Infra 的核心技术,为下一代智能应用的爆发构建坚实基础。
AI Infra:为谁而建,为何而建
下一代 AI Agent 的基石 = 开放 + 可扩展 + 实时
端到端、超低延迟语音 AI Agent 的技术栈与挑战(拟)
高性能推理服务如何让语音 AI 在硅谷落地
RWKV 驱动端侧低延迟语音 AI 落地实践(拟)
圆桌:实时 AI 的下一个十年
从更流畅拟人的端到端语音模型,到主动倾听与实时打断的全双工技术,再到前沿音频技术的突破与智能体落地——本论坛将深入探讨构建下一代语音 AI 的核心技术与未来方向。
讯飞智能语音技术进展(拟)
AI 时代智能语音交互的挑战与机遇
语音处理技术研究与应用进展
MiMo-Audio:语音领域的 GPT-3 时刻
生成式语音处理技术前沿
听觉认知与计算声学的最新进展
圆桌:对话式 AI 时代,语音技术的落地挑战和思考
聚焦创新型教育应用与模式
对话式AI重构教与学新体验(拟)
超越 “被动应答”:打造能推理、会共情的下一代教育 AI
会打字就能做智能体——AI 师傅助你千人千面做教学
答疑笔 × 子曰大模型,重构学生“问—解—练—评”闭环
HelloTalk 如何用 RTC+AI 构建语言学习社区的全球增长飞轮
教育即信任,增效创价值
新一代编程模型正在引发一场开发范式革命。如何赋能 AI 开发者,高效、稳定地构建下一代应用?又该如何设计新的协同模式,实现人机能力的最佳融合?本专场将聚焦前沿工具与开发流程,共同揭示人机协同编程的未来。
构建智能应用的新引擎:AWS Kiro 与 Stands Agent SDK 的实践与展望
「会说话」的 AI, 使用 TEN Framework 构建自然对话体验的工程哲学
构建有长期记忆的应用,memU 最佳实践(拟)
用 Vibe Coding 优化 Vibe Coding
AI Agent 下一代基础设施——Agent 沙箱技术实践
MiniMax 大模型服务在 Voice Agent 场景的应用
圆桌:Vibe Coding 的爱与恨
AI 与实时互动正在重塑我们与物理世界的连接方式。从无缝的语音交互到主动的多模态环境感知,一个万物皆智的时代正加速到来。本场论坛将探讨如何释放端侧 AI 的潜能,定义下一代智能终端。
FoloToy AI 玩具行业实践(拟)
AI Agent+IoT 技术方案新场景创新应用(拟)
端侧大模型的架构创新与应用
新一代 Kaldi 高效语音合成技术
Plaud 关于语音和大模型结合的思考(拟)
从多模态到智能体:AI+AR 驱动的人机共生
圆桌:2026 年,哪些端侧能力将成为现实?(拟)
多模态是从 LLM 到 AGI 的必经之路。从 AI 视频生成到可实时交互的世界模型,从被动响应到主动感知与交互,再到下一代多模态大模型的设计与构建——本专场将展望一个由实时多模态 AI 驱动的未来。
从文本推理到多模态交互:为什么是必经之路?
Neural Interactive Simulation as World Foundation Models
大模型时代下的多模态生成和理解
Bespoke HomeAI, Built for Belonging
World as Prompt, World as Interface
圆桌:从帮点一杯咖啡到 AGI——多模态的未来
对话AGI:实时智能互动的下一章(拟)
Models, Automation, and then?(拟)
Yangqing Jia is the Founder and CEO of Intent Lab and the Founder of Lepton AI, which was acquired by NVIDIA. A renowned AI scientist and entrepreneur, he created Caffe and Caffe2, co-created ONNX, and co-led PyTorch 1.0. He previously served in senior AI roles at NVIDIA, Alibaba, Facebook, and Google Brain and holds a Ph.D. in EECS from UC Berkeley.
圆桌1:国际视野+初创
圆桌2:行业落地商业验证
刘志理 北京冠客科技有限公司 CEO
二十三年营销实战管理经验,曾服务于科龙集团(家电上市公司)、三洋电机(世界500强)、欧迪办公(世界500强上市公司)、芭莎网(礼品行业独角兽)等,担任过大区经理、销售总监等职务。2016年进入机器人行业,精通渠道销售、大客户销售,擅长社会化营销及会议营销等。
ConvoAI Engine——对话式 AI 引擎
Call Agent——呼叫智能体
对话式 AI 开发套件
ConvoAI Infra
ConvoAI Copilot
STT——声网实时转录翻译
企业社会责任
服务线--客户故事
安全合规
海外视角AI+RTE案例
声网让 Agent 懂沟通、能成交转化 月薪只要2999元
让AI外呼告别“盲测”:美团与声网如何用评测基准定义行业标尺
从“能打通”到“能成交”:AI外呼在垂直行业的实战与迭代
从“听懂”到“办成”:大模型如何让企业客服真正长出“手脚”
从硅谷到东南亚:AI语音智能体如何跨越语言与文化的“最后一公里”
圆桌:Voice Agent +Fintech
智能应用的落地次第——从五个馒头看智能
对话式 AI:Agent 交互核心引擎重构人机协同体验革命
微软语音实时交互的技术创新与产品实践
从「对话」到「深度协同」:豆神 AI 大脑如何在生态中实现情景化智能
联想 AI 在海外终端设备的多元化实践(拟)
AI 语音客服的应用、市场机会和工程实践
AI赋能泛娱乐社交的新玩法与探索+全栈能力
出海破局与本地化
如何做到“万人直播间弹幕不卡、礼物不丢”(重点低延时)
技术实践:直播与语聊房的下半场,拼的是“全栈能力”
AI数字人
GenAI Video
AI+RTC 赋能政企业务创新的探索与实践
用 AI 会议纪要打造企业的“组织记忆”
从“闻声见人”到“智能交互”:5G 新通话打造 AI 自然语言服务普惠入口
日日新大模型助力电商全流程运营
Agent 时代,搜索不再为人而生
教育破局与新生:AI+全栈实时互动,重塑教育增长新范式
教育出海:全球低延迟与全栈互动
AI赋能与降本增效
高并发与高客单价
教育硬件
圆桌论坛:AI浪潮下的教育突围:存量博弈中,如何用“实时互动”重塑增长?
AI Infra:为谁而建,为何而建
下一代 AI Agent 的基石 = 开放 + 可扩展 + 实时
端到端、超低延迟语音 AI Agent 的技术栈与挑战(拟)
高性能推理服务如何让语音 AI 在硅谷落地
RWKV 驱动端侧低延迟语音 AI 落地实践(拟)
圆桌:实时 AI 的下一个十年
讯飞智能语音技术进展(拟)
AI 时代智能语音交互的挑战与机遇
语音处理技术研究与应用进展
MiMo-Audio:语音领域的 GPT-3 时刻
生成式语音处理技术前沿
听觉认知与计算声学的最新进展
圆桌:对话式 AI 时代,语音技术的落地挑战和思考
对话式AI重构教与学新体验(拟)
超越 “被动应答”:打造能推理、会共情的下一代教育 AI
会打字就能做智能体——AI 师傅助你千人千面做教学
答疑笔 × 子曰大模型,重构学生“问—解—练—评”闭环
HelloTalk 如何用 RTC+AI 构建语言学习社区的全球增长飞轮
教育即信任,增效创价值
构建智能应用的新引擎:AWS Kiro 与 Stands Agent SDK 的实践与展望
「会说话」的 AI, 使用 TEN Framework 构建自然对话体验的工程哲学
构建有长期记忆的应用,memU 最佳实践(拟)
用 Vibe Coding 优化 Vibe Coding
AI Agent 下一代基础设施——Agent 沙箱技术实践
MiniMax 大模型服务在 Voice Agent 场景的应用
圆桌:Vibe Coding 的爱与恨
FoloToy AI 玩具行业实践(拟)
AI Agent+IoT 技术方案新场景创新应用(拟)
端侧大模型的架构创新与应用
新一代 Kaldi 高效语音合成技术
Plaud 关于语音和大模型结合的思考(拟)
从多模态到智能体:AI+AR 驱动的人机共生
圆桌:2026 年,哪些端侧能力将成为现实?(拟)
从文本推理到多模态交互:为什么是必经之路?
Neural Interactive Simulation as World Foundation Models
大模型时代下的多模态生成和理解
Bespoke HomeAI, Built for Belonging
World as Prompt, World as Interface
圆桌:从帮点一杯咖啡到 AGI——多模态的未来