多模型调度」共找到 9697 篇相关文章

开源动态8

腾讯混元最新开源:一套RL框架打通个模态,庞天宇团队新作

大语言模型的RL技术已成熟,但模态生成模型的强化学习训练仍“各自为战”,制约AIGC模型能力上限。腾讯混元庞天宇团队开源UniRL框架,打通模态RL后训练,覆盖模型,内置算法与奖励组件。

量子位
产品应用8

0.3B参数,600MB内存!腾讯混元实现产业级2Bit量化,端侧模型小如手机App

腾讯混元团队推出面向消费级硬件的“极小”模型HY-1.8B-2Bit,参数量仅0.3B,内存占用600MB。它基于产业级2Bit端侧量化方案,生成速度提升,还通过种方法提升能力,未来将探索新技术缩小与全精度模型差距。

量子位
算法论文8

CMU&斯坦福提出Reasoning新范式!自己找“窍门”,教会LLM抽象Reasoning

大型语言模型解决复杂推理问题时效率低,论文提出创新方法,让模型利用“推理抽象”,通过RLAD两玩家强化学习框架训练,在基准测试提升性能,还分析了其作用、局限与未来方向。

深度学习自然语言处理
开源动态8

Github 8.7K star 厉害!!! 一款轻量好用的web自动化项目!

Nanobrowser是开源Chrome扩展工具,专注AI驱动的网页自动化。免费且本地运行,保护隐私,支持主流大模型。有智能体协同等特点,还介绍了安装配置方法,是高效安全的网页自动化之选。

开源先锋
产品应用7

AI开始学会合作?!实测4大Agent体=10个打工人

Agent热潮进入智能体时代,款产品涌现。鲸哥测评了它们在商业计划、运营设计等四大场景表现,总结各产品亮点与不足,指出Agent正推动大模型向“协作式智能群体”演进。

鲸选AI
算法论文8

数据邪修大法好:仅用文本数据就能预训练模态大模型

模态大模型研发中,行业认为无图文对就无模态能力。但ReVision研究表明,预训练阶段昂贵配对关系非必需,利用非配对数据统计信息修正文本表征,能实现跨模态互换,降低成本。

量子位
算法论文8

ACL'25 | CIGEval:一种基于模态大模型的可控生图评测智能体

阿里国际AI团队提出CIGEval,这是基于模态大模型驱动的图像生成评估智能体框架。它集成功能工具箱,通过任务拆解与工具调度提升评估准确性与可解释性,已在ComfyUI - Copilot上线。

PaperAgent
开源动态8

万亿思考模型夺下IMO金牌,无缝接入OpenClaw!一句话手搓丐版PS

2026年AI圈竞争激烈,闭源巨头巅峰对决时,开源社区迎来中国队的「技术核爆」。全球首个万亿级混合线性「思考模型」Ring - 2.5 - 1T开源,它能力强大,还能无缝接入Claude Code,实战表现亮眼。

新智元
产品应用8

谷歌DeepMind深夜放核弹:世界模型Genie 3登场,重新定义“生成式AI”

谷歌DeepMind推出第三代通用世界模型Genie 3,能生成样化交互式环境,可实时导航。它较前代有诸突破,有模拟物理特性等核心能力,能赋能具身智能体研究,但也存在行动空间有限等局限。

AI寒武纪
算法论文8

国内首篇!融合语言模型模态触觉传感器,推动机器人触觉迈向人类水平

清华大学丁文伯团队联合机构,受鸽子感知机制启发研发仿生模态触觉传感器 SuperTac,构建 8.5B 参数触觉语言模型 DOVE,成果发表于《Nature Sensors》,推动机器人触觉迈向人类水平。

机器之心