多模型兼容」共找到 9757 篇相关文章

算法论文8

SIGIR 2025 | 解决扩展和迁移难题,华为新加坡提出InstructRAG,提升高达19%

大语言模型任务规划面临可扩展性和可迁移性挑战,华为新加坡团队提出 InstructRAG 方案,通过智能体协同架构实现指令图扩展与少样本任务迁移,在数据集测试中性能提升高达 19.2%。

机器之心
新闻资讯8

LeCun新公司10.3亿美元种子轮融资,三顾茅庐拉谢赛宁入伙

图灵奖得主LeCun主导的AMI获10.3亿美元种子轮融资,投前估值35亿美元。团队抛弃大模型路线,转向联合嵌入预测架构,为通用人工智能提供新解法,还将落地领域,且承诺开源研究。

AIGC开放社区
新闻资讯8

首次,AI下棋不再是「黑盒」!

上海AI Lab发布升级版大模型「书生·思客InternThinker」,首度打破围棋AI推理黑盒,能用自然语言解释落子逻辑,具备职业3 - 5段棋力。依托创新训练平台InternBootcamp,它在任务表现出色,且相关技术有系列创新突破。

新智元
算法论文8

HyperEyes:从「搜得更深」到「搜得更宽」,并行模态搜索智能体的效率革命

小红书研究团队提出 HyperEyes 模型,打破现有模态搜索智能体串行处理模式困局。通过全栈设计实现并行模态搜索范式跃迁,在基准测试中表现优异,证明准确率与效率可协同进化。

机器之心
算法论文8

后训练中的RL已死?MIT新算法挑战传统后训练思维,谢赛宁转发

MIT研究人员提出RandOpt新算法,挑战传统后训练思维。该算法通过随机扰动和集成突破限制,在任务中表现出色,揭示了预训练模型权重空间的“神经丛林”现象,引发AI社区关注。

机器之心
产品应用7

Google 推出超小杯 AI:Gemma 3 270M!可进手机和浏览器

Google发布Gemma 3家族最小版本Gemma 3 270M,2.7亿参数,能耗低,在同规模模型中表现突出。设计理念是“够用就行”,适合特定任务,已在平台发布,开源策略效果好。

AI工程化
开源动态8

让AI看懂科研图表:深势科技开源150万高质量科研图文数据集

深势科技开源OmniScience数据集,含150万个高质量图文对。它利用先进工具攻克图文提取难题,经严格筛选成型,涵盖学科。还设计重写流水线提升图文语义契合度,基于此训练的模型表现优异。

AIGC开放社区
算法论文8

单向VLM变双向!人大斯坦福等提出MoCa框架:双向模态编码器

人大、斯坦福等机构提出MoCa框架,将单向视觉语言模型转化为双向模态嵌入模型。它通过持续预训练和异构对比微调,解决传统模型局限,在模态基准测试中表现优异,尤其小规模模型性能突出。

新智元
7

27 岁,市值三万亿刀

9月27日Google迎27岁生日,Alphabet市值突破三万亿美元。Gemini 2.5等模型发布显进攻态势,AI成市值增长引擎。不过,Google面临反垄断案和监管压力,同时在领域布局AI重塑商业版图。

MacTalk
开源动态8

谷歌最新「0.27B」Gemma 3开源!身板小却猛如虎,开发者直呼救命稻草

模型时代开发者算力焦虑严重,谷歌Gemma 3系列另辟蹊径。新成员Gemma 3 270M参数规模小但性能强,如在IFEval测试表现突出,有小体积强架构、省电等亮点,适用于场景。

新智元