多模型」共找到 9751 篇相关文章

算法论文8

让RAG真正读懂“言外之意”!新框架引入词汇样性,刷新项基准SOTA

ACL 2025研究提出Lexical Diversity - aware RAG (DRAG) 框架,将词汇样性引入RAG检索与生成,解决现有方法痛点。它有两大创新模块,实验在基准提升准确率,还将在多模型上增益,代码即将开源。

量子位
产品应用8

4K超分Agent修图师来了!一键救活所有模糊照片

传统图像放大模型应对复杂情况力不从心,4KAgent应运而生。它基于智能体设计,有感知、复原等模块,能为图像定制4K超分方案,在领域测试中表现出色,无需特定领域再训练。

量子位
开源动态8

The Batch:820 | Qwen3 向 DeepSeek-R1 发起挑战

阿里巴巴发布八个大型语言模型权重,含两个 MoE 架构和六个稠密模型。预训练数据达 36 万亿 token,支持 119 种语言及方言。测试中 Qwen3 家族表现出色,或终结 DeepSeek - R1 霸主地位,设计用于智能体系统。

DeeplearningAI
新闻资讯8

OpenAI还在讨论“异星心智”,乐享科技已经造出来了|甲子光年

本文对比OpenAI对异星机器心智的风险预警,介绍中国乐享科技基于仿生神经科学思路,研发出面向机器人的以太大模型,已完成场景验证,将举办户外开放直播测试,探索具身智能新路线

甲子光年
算法论文8

Sea AI Lab 揭秘:你费尽心力调的 LLM 一直在崩溃?罪魁祸首可能只是一个参数:BF16

Sea AI Lab 和新加坡国立大学研究指出,强化学习微调中训练不稳定和性能瓶颈,根源是数值精度 BF16。其低精度造成“训练 - 推理不匹配”,使训练易失败。将精度切换到 FP16 可解决问题,提升模型表现。

AI寒武纪
算法论文8

WWW'26 | 跨任务自适应的Multi-Agent协作新范式

大型语言模型驱动的智能体系统成解决复杂任务重要范式,但智能体协作存在关键问题。Griffith和西北农林科技大学团队提出OFA - MAS,将智能体拓扑设计从one - for - one推向one - for - all,实验效果佳。

PaperAgent
开源动态7

挑战 Claude Code,9.5 万星!又一款开源 AI 编程神器火了

开源AI编程工具OpenCode亮相,具备原生终端界面、会话支持,兼容75种以上模型,提供桌面版和IDE插件。它允许沿用付费订阅,内置免费模型,与种LSP服务器整合,适配种编辑器,采用‘隐私优先’架构设计。

InfoQ
开源动态8

谷歌痛失王座?港科大贾佳亚团队DreamOmni2开源,超强P图暴击Nano Banana

港科大贾佳亚团队开源DreamOmni2,该模型基于FLUX Kontext,能处理参考图像,在模态编辑与生成上表现出色,超越谷歌Nano Banana等模型,还构建了新测试集与数据构建范式。

新智元
算法论文8

AI4S回归白盒符号主义,清华等联合发布SR-LLM:自主发现科学知识

清华大学等所高校联合发布SR - LLM,这是融合大语言模型与深度强化学习的符号回归框架。它从数据生成可解释数学模型,在跟车行为建模等任务表现优,为机器自主科学发现开辟新路径。

新智元
算法论文8

从「记忆解题」到「深度推理」:港科大推出首个本科数学动态评测基准 UGMathBench

港科大团队发表在 ICLR 2025 的研究 UGMathBench,是首个本科数学动态评测体系。它涵盖 16 个学科领域,通过变量扰动创建版本试题,引入创新指标评估模型推理能力,测试结果揭示了当前模型短板。

AI科技大本营