任务型语音对话」共找到 2670 篇相关文章

产品应用8

最强编码模型 Fable 5.1 发布:性能翻倍、Agent 成本降 45%,Anthropic 把顶级模型送进真实世界

当地时间9月1日,Anthropic发布Claude Fable 5.1和Claude Mythos 5.1,新模型在多方面能力提升,Agent工作负载成本最高降45%,此次发布还涉及价格、数据留存等多方面内容,争夺高价值任务市场。

InfoQ
算法论文7

预测下一个像素还需要几年?谷歌:五年够了

谷歌DeepMind研究者分析下一像素预测在图像识别与生成任务中的扩展特性。实验显示其扩展趋势与文本类似但效率低,最优策略因任务和分辨率而异,预计未来五年逐像素建模可行。

机器之心
算法论文8

ICML 2025 | 西湖大学吴泰霖研究员团队:组合生成式多物理场多元件PDE仿真

西湖大学吴泰霖课题组联合多方提出“组合生成式多物理场多元件PDE仿真(M2PDE)”,将仿真问题视为生成式概率建模任务。该成果在多任务测试中表现卓越,被ICML 2025接收。

力学与人工智能
开源动态8

AI记忆革命爆发!Clawdbot如何像大脑般记住一切

2026年初开源个人AI助手Clawdbot引爆社区。它可本地运行、集成聊天平台、自主处理任务,有长时记忆和任务执行能力。AI研究工程师Manthan Gupta复盘其记忆机制原理,涉及上下文、记忆存储、搜索等内容。

新智元
新闻资讯8

OpenAI 发布GDPval,可真实评估现实世界经济价值。Claude Opus 4.1 拿下第一

OpenAI推出GDPval,可评估AI在真实经济价值任务上的表现。它从9个行业选44种职业,设1320个真实任务。Claude Opus 4.1表现最佳,前沿模型速度快、成本低。OpenAI计划扩展GDPval,还开源部分内容。

AGI Hunt
算法论文7

UniSteer用机械臂「拼豆」:让人类指导进入VLA噪声空间强化学习

视觉 - 语言 - 动作模型(VLA)是机器人操作重要基础模型,但复杂任务成功率低,真机强化学习成本高。微软等机构研究者提出 UniSteer,将人类纠正转换成噪声监督,在多任务测试中提升了成功率。

机器之心
产品应用8

千人千面的真人级AI名师,劈开教育「不可能三角」

与爱为舞推出的AI导师能个性化教学,服务百万用户。其用「模型+语音+工程」铸造技术巨剑。经训练,AI可驾驭课堂,再经自研语音模型实现交互,通过链路优化等实现规模化落地,践行「全员皆超级个体」理念。

量子位
算法论文8

AI学会左脚踩右脚自进化?Meta华人新研究改写Agent法则

Meta华人学者Jenny Zhang联合多机构研究者提出新智能体框架HyperAgents(DGM - H)。它打破任务能力与自我改进能力需对齐的局限,能跨任务自我改进,还自动生成基础设施,或改写Agent竞争规则。

新智元
开源动态8

视频字幕处理开源神器

卡卡字幕助手(VideoCaptioner)操作简单,无需高配置,支持 API 和本地离线语音识别,利用大语言模型处理字幕。它支持多平台视频下载处理,有专业语音识别引擎,能智能纠错、高质量翻译、调整字幕样式。

GitHubStore
推荐文章7

《动手写AI Agent》会话与记忆:记住上次聊到哪了

文章围绕《动手写AI Agent》的会话与记忆展开,指出LLM无状态、无会话持久化会让对话记录丢失。介绍了解决方案,如把对话存到磁盘及构建长期记忆,阐述设计决策并提到文件系统存储方案。

AI Reading Hub