忘掉是为了记住——为了保持记忆质量,Tolan 每晚都会运行压缩任务,删除低价值或冗余条目(例如「用户今天喝了咖啡」)并解决记忆中的矛盾之处。 哈喽大家好~这是 Voice Agent 学习笔记系列的又一篇深度分享。我是课代表瓒 an👩�…
声浪
OpenAI 揭秘 Tolan 背后 AI 技术:如何让语音智能体拥有连贯记忆和稳定人格?
22 0 0
阶跃星辰CEO姜大昕确认演讲,微软、Google、小米、小红书、Kimi的专家同台分享Agent实践
Agentic AI Summit 2026将于2026年1月16-17日在中关村展示中心会议中心举办,汇聚500+技术精英,覆盖Agent技术全链路。会议内容设置上,从技术底座层面、开发工具层面、数据工程与记忆系统、可信治理与评估体系,到…
20 0 0
MiniMax今早上市,763亿港元,大模型公司最大规模IPO!开盘前大涨50%
来源丨新智元 MiniMax 终于在今早 9:30 于港交所上市了!截稿时,今早上市的 MiniMax 股价已疯涨近 80%!MiniMax 吸引全球顶级长线加仓香港,引领中国科技股上涨,走出独立行情。MiniMax 仅用 OpenAI 1…
18 0 0
【语音技术和应用趋势分享系列(5,6/10)】具身智能和多模态时代的交互
本系列十篇文章,旨在对之前提到的十大趋势进行详细剖析。系列中将穿插科普、技术综述、技术发展路线,以及来自我个人与其他行业专家的思考。希望不论读者此前对语音技术与应用了解多少,都能从这一系列文章中获得有价值的观点。 本篇将围绕趋势五和六——“…
18 0 0
英伟达开源实时语音智能体的终极 ASR:24ms 极速锁定。
NVIDIA(英伟达)最近开源了最新的Nemotron Speech ASR模型。这是一款专攻低延迟、实时流式场景的语音识别模型。 做 AI 语音开发的朋友都知道,ASR(语音转文字)一直是实时交互中那块难啃的骨头。尤其是 Streamin…
29 0 0
Index-ASR技术报告(bilibili团队出品)
标题:Index-ASR Technical Report 链接:https://arxiv.org/pdf/2601.00890 发表日期:2026年1月6号 作者单位:Artificial Intelligence Platform D…
35 0 0
TASLP 2026 | 仅需少量样本,让AI“听音观像”:语义调制提示学习框架 SMP
小样本视听分类(Few-Shot Audio-Visual Classification, FS-AVC)是多模态学习领域极具挑战性的任务。它要求模型在仅有极少量标注样本的情况下,通过挖掘视觉与听觉的互补信息,实现对新类别的准确识别。 然而…
17 0 0
