「多模型协作」共找到 9907 篇相关文章
ICML 2025 | 长视频理解新SOTA!蚂蚁&人大开源ViLAMP-7B,单卡可处理3小时视频
在视觉语言模型取得突破的当下,长视频理解挑战凸显。蚂蚁和人大团队提出视觉语言大模型ViLAMP,采用‘混合精度’策略,在多基准测试中超越现有方案,单卡可处理3小时视频,为实际应用带来新可能。
为什么95%的智能体都部署失败了?这个圆桌讨论出了一些常见陷阱
硅谷圆桌论坛指出,95%的AI智能体部署失败,原因并非模型不智能,而是基础框架、上下文工程等未成熟。还探讨了上下文工程实践、信任治理、记忆设计、多模型编排等问题,给出创业者需思考的问题。
LLM加RL遭质疑:故意用错奖励,数学基准也显著提升,AI圈炸了
华盛顿大学等机构论文引爆AI界,其发现用虚假奖励训练Qwen2.5-Math-7B模型,也能提高MATH - 500成绩。虚假奖励对Qwen模型有效,但在其他模型上有限,凸显RLVR有效性与模型能力有关。
又一款国产高性能GPU问世,实力对标海外巨头
2025年9月22日,芯动科技发布“风华3号”全功能GPU,它架构全面,功能覆盖广,在大模型等领域有多个突破,还适配多生态与系统。该产品能为多行业定制服务,标志国产GPU进入规模化应用阶段。
阿里开源 Team 版 OpenClaw,5分钟完成本地安装
阿里开源 Team 版 OpenClaw——HiClaw,它是 OpenClaw 超进化版,引入 Manager Agent 角色,解决了 OpenClaw 在安全、多任务协作、移动端体验、记忆管理等方面的痛点,还集成多个开源组件,部署简单,适合开发者和企业。
告别AI“乱画图表”!港中文团队发布首个结构化图像生成编辑系统
现有AI生图工具在结构化图像生成上问题多,理解与生成能力有鸿沟。港中文等校联合团队提出首个综合性方案,涵盖数据集构建、模型优化、评估基准三大模块,助多模态模型画准图,推动其发展。
“现在的AI就像1880年的笨重工厂!”微软CSO斯坦福泼冷水:别急着造神
微软首席科学官 Eric Horvitz 在斯坦福商学院演讲,称当下 AI 如 1880 年代刚用电的工厂,底层大模型与商业未契合。他指出模型概率校准不足、医疗 AI 难移植等问题,还谈及人类与 AI 协作及内容溯源等。
梁文锋,Nature全球年度十大科学人物!
权威科学期刊《自然》公布2025年度十大科学人物榜单,梁文锋因DeepSeek模型对AI领域的重要贡献与变革性影响成功当选。此外,中国研究员杜梦然也因相关研究入选,还有多位其他领域人物因各自成就上榜。
将DSA注意力引入多模态,快手Keye2.0开启强化推理新范式
快手发布新版多模态大模型Keye-VL-2.0-30B-A3B,率先将DSA机制引入多模态理解场景,解锁256K超长上下文深度感知,还首次解锁Agent协作机制。该模型在多方面表现出色,且将融入业务带来收益。
DeepSeek比你更懂反思!谷歌重磅发现,智能的本质竟是一场社会化对话
谷歌等机构研究发现,像DeepSeek - R1等推理模型思考复杂问题时,内部模拟多角色辩论赛,形成思维社会机制,让AI准确率提升,证明智能本质或是内化社会互动,还为调优AI提供新方法。