「任务型语音对话」共找到 2678 篇相关文章
大模型「越用越快」!SpeedupLLM首次验证,大降56%推理预算
Emory大学研究者提出SpeedupLLM框架,利用动态计算资源分配和记忆机制,使LLM处理相似任务时推理成本降56%、准确率提升,论文系统性验证了LLM“越用越快”,为AI模型发展提供新思路。
阿里深夜开源王炸Agent!硬刚OpenAI,性能全面SOTA!
过去半年,开源Agent在解决复杂难题时难敌OpenAI。昨天阿里通义开源WebSailor模型,用完整可复现方法论挑战闭源霸权,通过构造L3合成数据、取精华训练轨迹、两步走训练策略提升性能。
ICCV 2025|降低扩散模型中的时空冗余,上交大EEdit实现免训练图像编辑加速
上海交通大学EPIC Lab团队提出EEdit框架,入选ICCV 2025。它是首个加速匹配流模型图像编辑框架,能兼容多种引导方案,免训练,速度较原始工作流快2.4倍,支持多类型编辑任务。
狂涨 9.5K star!!又一款轻量好用的web自动化项目,太爽了!!
介绍开源项目Nanobrowser,它是基于Chrome扩展的AI网页自动化工具,通过多智能体协作系统理解自然语言指令完成复杂网页任务,开源免费、保障隐私,有诸多实用功能,已获9.5K star。
交大&华为联手:AI智能体进化的五种关键能力
随着大型语言模型兴起,基于LLM的聊天机器人能完成多样语言任务。上海交通大学和华为团队提出分析框架,探讨LLM聊天机器人向AI智能体进化的五个关键维度、改进方法及未来发展方向。
11Labs 增长负责人:搞营销要学着做视频,但创始人出镜会有点自恋
AI语音独角兽ElevenLabs增长迅猛,估值超30亿美元。其增长负责人Luke Harries分享独特策略,如分业务单元管理、重视视频营销、多渠道推广等,还给出团队搭建、产品发布等实用建议。
具身进化·无界未来:这场论坛引领具身智能模型革命新浪潮
5月29日,2025张江具身智能开发者大会相关论坛举行,汇聚专家探讨热点话题。张江集团推动产业发展,多位嘉宾分享成果与思考,圆桌对话也各抒观点,为具身智能发展描绘蓝图。
Claude:拆书
作者借助Claude大模型换角度“拆书”,以《金刚经》《我与地坛》《传习录》《当下的力量》为例,探寻让作者写作的终极问题、真正对话对象、关键转向及暗门密码,还给出拆书Prompt。
CoT推理大溃败?哈佛华人揭秘:LLM一思考,立刻就「失智」
新研究揭示思维链CoT会分散模型「注意力」,使大模型推理时易出错。研究指出在需遵守指令任务中,用CoT推理模型准确率下降,还总结了四大模式,并提出四种缓解策略。
深度解析大模型技术演进脉络:RAG、Agent与多模态的实战经验与未来图景
大模型作为产业变革核心引擎,RAG、Agent与多模态技术重塑AI与现实交互边界。本文解析技术演进脉络、实战经验与未来图景,介绍三者在各领域应用及面临挑战,为产业升级提供指引。