使用微信扫一扫分享到朋友圈
使用微信扫一扫进入小程序分享活动
赵斌,声网创始人兼CEO。2014年创立声网,开创了全球实时互动云服务。2020年6月26日,声网母公司 Agora, Inc.成功登陆纳斯达克,股票代码 为“API”。声网服务的企业遍布社交、教育、IoT、金融、医疗等20余行业,200多种场景。在此之前,赵斌也曾参与两家美国纳斯达克上市公司的创立。1997年,作为创始工程师之一参与WebEx (网讯) 创业。2007年,作为CTO参与YY (欢聚时代)创业。
Yangqing Jia is the Founder and CEO of Intent Lab and the Founder of Lepton AI, which was acquired by NVIDIA. A renowned AI scientist and entrepreneur, he created Caffe and Caffe2, co-created ONNX, and co-led PyTorch 1.0. He previously served in senior AI roles at NVIDIA, Alibaba, Facebook, and Google Brain and holds a Ph.D. in EECS from UC Berkeley.
谢磊,西北工业大学计算机学院教授、博士生导师,音频语音与语言处理实验室(ASLP@NPU)负责人。主要研究方向包括语音处理、对话式人工智能,以及面向语音与语言技术的先进神经网络模型与大模型技术,在语音增强、自动语音识别、语音合成与语音对话等领域开展了系统性研究。他长期致力于建设面向学术界的开源工具与数据资源,指导了被广泛使用的 WeNet 语音识别工具包和 WenetSpeech 开源语音数据系列等项目。他曾获得多项荣誉,包括教育部新世纪优秀人才支持计划、陕西省青年科技新星、全球前2%顶尖科学家(斯坦福大学 & Elsevier)以及华为云 AI 名师等。已发表论文 400 余篇,Google Scholar 引用超过 20000 次。曾获多项国际会议最佳论文奖及国际评测冠军,诸多研究成果已实现产业落地。担任 ISCA SIG-CSLP 副主席、IEEE/ACM TASLP 与 IEEE SPL 的高级领域编委(SAE)。
张如欢,当前任MiniMax资深AI架构师,拥有10多年AI行业经验,经历Voice Agent 1.0至AIGC时代的技术演进。主导多项创新智能交互AI产品的落地。具备较深厚的技术洞察与商业化能力。
毕业于中国人民解放军外国语大学,在教育、文化传媒、人工智能以及实时互动云服务领域有二十余年的行业和管理经验。目前负责统筹商业化、服务、运营侧资源,推动声网业务规模与市场影响力的持续提升。
刘志理 北京冠客科技有限公司 CEO
二十三年营销实战管理经验,曾服务于科龙集团(家电上市公司)、三洋电机(世界500强)、欧迪办公(世界500强上市公司)、芭莎网(礼品行业独角兽)等,担任过大区经理、销售总监等职务。2016年进入机器人行业,精通渠道销售、大客户销售,擅长社会化营销及会议营销等。
IEEE Fellow,国家千人计划专家,康奈尔大学计算机科学博士,本科毕业于北京大学计算机系,国际数学奥林匹克 IMO 金牌得主。曾担任 AT&T 香农实验室高级研究员、美国德克萨斯大学奥斯汀分校终身副教授,斩获 NSF CAREER Award、ACM SIGMETRICS 时间检验奖等多项国际权威奖项,发表10余篇网络顶会 SIGCOMM 论文,拥有 20 余项美国及国际专利。归国后多次创业,先后落地国内首个网页 P2P 视频方案,打造黑咔相机等亿级用户 AI 视频产品。现任秒瞰科技 CEO,研发无极云实时音视频云。
施新华-阿里ATH资深架构师
探索大模型技术的行业场景应用,驱动行业的AI应用发展。
2010年加入阿里,在阿里巴巴集团的核心业务中积累了丰富经验。曾深度参与支付宝快捷支付与扫码支付的创新实践,助力塑造现代支付方式;并在淘宝期间领导智能客服系统的发展,推动电商平台智能化服务升级。
由声网和 RTE 开发者社区主办的实时互联网大会( RTE 大会)创办于 2015 年,至今已经连续举办十一届。2015 年至今,实时互联网大会从专门面向开发者的技术交流会议,发展为全球音视频领域最具影响力的行业盛会,期间不仅伴随着实时互动行业的成长,还见证了行业从 RTC 实时通讯技术发展到 RTE 实时互动场景 & 产业的爆发。
今年,RTE 大会正式升级为 “ iRTE 实时智能大会”,这是全球首个聚焦“实时智能”的全产业峰会,探讨 RTE 技术如何成为多模态大模型、具身智能、AI Agent 与物理世界交互的“神经系统”,推动 AI 从“云端思考”走向“实时交互”。
对话AGI:实时智能互动的下一章(拟)
Models, Automation, and then?(拟)
圆桌对话
圆桌对话
声网最新产品发布、最新动态分享
企业级客服智能体正加速规模化落地。本论坛将围绕 Voice Agent 的技术演进、业务闭环与价值衡量,探讨智能体如何从“能对话”迈向“能办事、能转化、能增长”。
从端到端语音模型到边听、边说、边思考、边执行的新型全模态架构,本论坛将探讨下一代对话式 AI 的模型演进、全双工交互范式与能力边界。
从 Demo 到真正可用的语音智能体,需要跨过哪些实时互动技术门槛?从语音链路到全双工、打断与延迟优化,一次补齐开发者最需要的 RTE 基础技术栈。
汇聚年度最受瞩目的对话式 AI 软硬件创新场景。在群体信号与个体非共识之间,捕捉下一代实时互动新可能。
在文字诞生之前,人类通过对话交换情感和思想——充满温度与实时反馈。今天,AI 与实时互动技术正引领一场「对话式社会」复兴,让沟通回归本能。本场论坛,我们将探讨对话式智能体的技术与未来,见证下一代人机交互的诞生。
2025年全球社交应用内购收入达150亿美元,同比增长16%,线上社交与泛娱乐持续全球扩张。生成式AI成为关键变量,推动实时互动从人与人扩展到人与Agent。本论坛将围绕社交娱乐新玩法、实时内容生成、AI陪伴与全球化增长等议题,共探在线社交娱乐的演进方向与增长新路径。
IoT 正加速渗透家居、教育、陪伴等真实场景,而实时互动与大语言模型能力的引入让更多此前不存在的场景变成现实。本论坛将围绕多模态智能、模型与开发者,芯片与终端等主题,探讨技术趋势、场景落地与全球化增长,共同关注开源创新与 AI 新终端带来的产业机会。
从复杂声学环境下的语音识别与声学处理,到行业应用适配、个性化识别与安全验证。聚焦语音 AI 在真实场景落地中的关键挑战。
从高并发、全球网络与质量观测,到音视频编解码、WebRTC 与 SDK,一起探讨 RTE 核心技术的持续演进。
线上教育正迈入稳定发展与价值深耕的新阶段,用户需求、教学场景与服务模式也在持续演进。AI为内容生产、个性化学习、智能辅导与教学评估注入新动能,实时互动进一步提升线上教学体验。本论坛将围绕AI落地、实时互动及教育模式创新,共探线上教育的新突破与增长空间。
AI Coding 正在改变开发者的工作方式,Skills 也让经验、工具和工作流更容易被沉淀和复用。与此同时,Agent 开发正在从简单调用走向更复杂的协作和工作流。本论坛邀请 AI Coding、Skills 和 Agent 开发方向的一线实践者,聊聊他们正在做什么、遇到了什么问题,以及开发工具正在发生哪些真正值得关注的变化。
AI 视频生成正从异步迈向实时,并与对话式数字人、世界模型深度融合。本论坛聚焦实时视频、空间音频与编解码,探索下一代沉浸交互。
当大模型从文本走向语音、视觉等多模态 Omni 推理,低延迟、高并发与流式调度成为新的基础设施挑战。本论坛将携手一线 Infra 专家共同探寻支撑下一代实时智能的技术底座。
对话AGI:实时智能互动的下一章(拟)
赵斌,声网创始人兼CEO。2014年创立声网,开创了全球实时互动云服务。2020年6月26日,声网母公司 Agora, Inc.成功登陆纳斯达克,股票代码 为“API”。声网服务的企业遍布社交、教育、IoT、金融、医疗等20余行业,200多种场景。在此之前,赵斌也曾参与两家美国纳斯达克上市公司的创立。1997年,作为创始工程师之一参与WebEx (网讯) 创业。2007年,作为CTO参与YY (欢聚时代)创业。
Models, Automation, and then?(拟)
Yangqing Jia is the Founder and CEO of Intent Lab and the Founder of Lepton AI, which was acquired by NVIDIA. A renowned AI scientist and entrepreneur, he created Caffe and Caffe2, co-created ONNX, and co-led PyTorch 1.0. He previously served in senior AI roles at NVIDIA, Alibaba, Facebook, and Google Brain and holds a Ph.D. in EECS from UC Berkeley.
圆桌对话
圆桌对话
ConvoAI Engine——对话式 AI 引擎
Call Agent——呼叫智能体
对话式 AI 开发套件
ConvoAI Infra
ConvoAI Copilot
STT——声网实时转录翻译
企业社会责任
服务线--客户故事
安全合规
海外视角AI+RTE案例
声网让 Agent 懂沟通、能成交转化 月薪只要2999元
让AI外呼告别“盲测”:美团与声网如何用评测基准定义行业标尺
从“能打通”到“能成交”:AI外呼在垂直行业的实战与迭代
从“听懂”到“办成”:大模型如何让企业客服真正长出“手脚”
从硅谷到东南亚:AI语音智能体如何跨越语言与文化的“最后一公里”
圆桌:Voice Agent +Fintech
智能应用的落地次第——从五个馒头看智能
对话式 AI:Agent 交互核心引擎重构人机协同体验革命
微软语音实时交互的技术创新与产品实践
从「对话」到「深度协同」:豆神 AI 大脑如何在生态中实现情景化智能
联想 AI 在海外终端设备的多元化实践(拟)
AI 语音客服的应用、市场机会和工程实践
AI赋能泛娱乐社交的新玩法与探索+全栈能力
出海破局与本地化
如何做到“万人直播间弹幕不卡、礼物不丢”(重点低延时)
技术实践:直播与语聊房的下半场,拼的是“全栈能力”
AI数字人
GenAI Video
AI+RTC 赋能政企业务创新的探索与实践
用 AI 会议纪要打造企业的“组织记忆”
从“闻声见人”到“智能交互”:5G 新通话打造 AI 自然语言服务普惠入口
日日新大模型助力电商全流程运营
Agent 时代,搜索不再为人而生
讯飞智能语音技术进展(拟)
AI 时代智能语音交互的挑战与机遇
语音处理技术研究与应用进展
MiMo-Audio:语音领域的 GPT-3 时刻
生成式语音处理技术前沿
听觉认知与计算声学的最新进展
圆桌:对话式 AI 时代,语音技术的落地挑战和思考
FoloToy AI 玩具行业实践(拟)
AI Agent+IoT 技术方案新场景创新应用(拟)
端侧大模型的架构创新与应用
新一代 Kaldi 高效语音合成技术
Plaud 关于语音和大模型结合的思考(拟)
从多模态到智能体:AI+AR 驱动的人机共生
圆桌:2026 年,哪些端侧能力将成为现实?(拟)
教育破局与新生:AI+全栈实时互动,重塑教育增长新范式
教育出海:全球低延迟与全栈互动
AI赋能与降本增效
高并发与高客单价
教育硬件
圆桌论坛:AI浪潮下的教育突围:存量博弈中,如何用“实时互动”重塑增长?
AI Infra:为谁而建,为何而建
下一代 AI Agent 的基石 = 开放 + 可扩展 + 实时
端到端、超低延迟语音 AI Agent 的技术栈与挑战(拟)
高性能推理服务如何让语音 AI 在硅谷落地
RWKV 驱动端侧低延迟语音 AI 落地实践(拟)
圆桌:实时 AI 的下一个十年
对话式AI重构教与学新体验(拟)
超越 “被动应答”:打造能推理、会共情的下一代教育 AI
会打字就能做智能体——AI 师傅助你千人千面做教学
答疑笔 × 子曰大模型,重构学生“问—解—练—评”闭环
HelloTalk 如何用 RTC+AI 构建语言学习社区的全球增长飞轮
教育即信任,增效创价值
构建智能应用的新引擎:AWS Kiro 与 Stands Agent SDK 的实践与展望
「会说话」的 AI, 使用 TEN Framework 构建自然对话体验的工程哲学
构建有长期记忆的应用,memU 最佳实践(拟)
用 Vibe Coding 优化 Vibe Coding
AI Agent 下一代基础设施——Agent 沙箱技术实践
MiniMax 大模型服务在 Voice Agent 场景的应用
圆桌:Vibe Coding 的爱与恨