端到端对话模型」共找到 8308 篇相关文章

算法论文8

超越RAG和DAPT!华人团队新研究引热议:即插即用、无需改变原参即可让模型化身领域专家

华人团队提出比DAPT和RAG更方便、成本更低的方法,即“Memory Decoder”预训练记忆模块。它像“领域知识插件”,即插即用、不改原参,能让Qwen、Llama等模型成领域专家,还降低困惑度。

量子位
产品应用7

数字技术工人已到岗!时序大模型+Agent已掌握了工厂生产管控技术,比人类更懂工况

基于时序大模型和Agent的数字技术工人,能承担生产操作等关键任务,接手复杂工业环节。国内AI团队打造的河谷平台构建智能体,自研底层技术,以工艺维度训练,上岗快,极峰科技还创新商业模式。

量子位
算法论文8

RL 将如何提高具身大模型 VLA 泛化性?清华大学团队NeurIPS 2025文章分析 RL 与 SFT 泛化性差异

清华大学团队在NeurIPS 2025发表文章,揭示强化学习(RL)提升具身大模型VLA泛化能力的优势,对比其与SFT差异,还提出评测基准和训练方法,为VLA训练提供新方向。

机器之心
开源动态7

程序员下班一看懵了?白嫖 Gemini / 本地大模型做时间追踪,用这个开源小工具给你一天自动出「git log」

Dayflow 是原生 macOS 开源应用,能以 1 FPS 录屏,用 AI 总结生成时间线,解决传统时间追踪记录不具体问题。它功能丰富,有自动时间线、分心高亮等,还支持多种 AI 模式,数据隐私性好。

小华同学ai
算法论文8

DMLR 2026 | RPI Shaowu Pan(潘韶武)团队 Nithin Somasekharan等:CFDLLMBench——首个面向计算流体力学的大语言模型综合基准评测

文章介绍针对CFD领域的综合LLM评测基准CFDLLMBench,构建三层递进挑战体系。实验揭示主流LLM在‘知道’与‘做到’间有差距,多智能体框架可提升成功率,代码与数据集已开源。

力学与人工智能
产品应用8

99%的AI产品都没有真正的护城河,初创产品需要做好「细分场景+生态协同」 | 对话AI播客工具Podwise

量子位智库对话Podwise创始团队,探讨AI播客工具发展。团队分享Podwise目标用户、场景、优势,如转录准、能识别声纹等。还谈及产品开发、付费、用户增长等策略,强调做好细分场景与生态协同。

量子位
算法论文8

视频世界模型跑长序列不「崩」了!用光流约束+历史记忆+多步训练,让动态场景稳如磐石

现有视频世界模型在长时间交互中易出现运动不合理与场景崩坏问题,核心原因是误差累积。MagicWorld提出面向长时稳定性的交互式建模框架,通过光流约束、历史缓存检索和多步聚合训练,有效缓解误差累积。

量子位
推荐文章8

62岁软件教父Martin Fowler警告:AI泡沫下,裁员潮印证行业萧条,大模型正将编程拖入“非确定性深渊”!

62岁软件教父Martin Fowler在The Pragmatic Engineer节目中谈AI对软件开发的影响。他认为当下行业萧条,AI有泡沫,编程从确定性转向非确定性带来挑战,也催生新工作流程,还强调测试、重构等的重要性。

InfoQ
新闻资讯8

xAI 新模型 Grok 4 Fast 卷疯了!少用 40% token 还能追平 Grok 4,限定范围可直接免费用

近日,马斯克旗下 xAI 推出新 AI 模型 Grok 4 Fast,将非推理与推理能力整合,少用 40% token 追平 Grok 4,运行成本降 98%。它有 200 万 token 窗口,多平台可用,部分范围免费。

InfoQ
新闻资讯8

AMD 苏妈对话李开复:AI 转型只能由 CEO 驱动、未来“DRI”(直接负责人)将是企业核心|直击现场

2026 AMD AI 开发者日上海站,AMD 苏姿丰阐述 AI 愿景及中国战略。她与李开复对话,李开复认为 AI 跨越编程临界点,多智能体架构是突破,AI 转型需 CEO 驱动,未来 DRI 将成企业核心。

InfoQ