K2.5模型」共找到 9243 篇相关文章

算法论文8

何恺明新作:给扩散模型加正则化,无需预训练无需数据增强,超简单实现性能提升

何恺明最新论文研究扩散模型与表征学习的联系,提出Dispersive Loss正则化方法。它无需正样本对,有高通用性、低计算开销等优势,在多模型测试中提升了生成质量,在其他任务也有潜力。

量子位
开源动态8

3B模型性能小钢炮,“AI下半场应该训练+验证两条腿跑步”丨上海AI Lab&澳门大学

上海AI Lab和澳门大学联合发布通用答案验证模型CompassVerifier与评测集VerifierBench,填补Verifier领域循环迭代体系空白。AI下半场评估比训练更重要,当前验证方法有困境,新模型验证精度高且能用于强化学习。

量子位
新闻资讯8

Claude彻底起飞!狂揽亚马逊5GW算力+250亿刀,贝索斯赚麻了

4月20日,Anthropic与亚马逊签署超级大规模AI基础设施协议,1000亿美元十年砸向AWS算力,锁定5吉瓦用于训练和部署Claude。亚马逊追加投资,Anthropic营收猛增,此合作揭示AI竞争转向基础设施。

新智元
开源动态8

3.2K Star!这个开源字幕神器,对剪视频的创作者来说,救了大命!

视频创作中字幕制作耗时费力,剪映等工具各有局限。开源字幕工具 AutoSubs 能有效解决痛点,可一键生成高质量字幕、自动区分说话人,本地运行保障隐私,还具备多种亮点功能,使用简单。

开源星探
算法论文8

让机器人在“想象”中学习世界的模型来了!PI联创课题组&清华陈建宇团队联合出品

斯坦福Chelsea Finn课题组与清华陈建宇团队联合提出可控生成世界模型Ctrl - World,可让机器人在“想象空间”预演任务。该模型使用零真机数据,提升下游任务指令跟随成功率。其相关论文已发布于arXiv平台。

量子位
算法论文8

世界模型迎来因果升级:CD-LAM仅用几千步微调即可显著增强动作控制

Aether AI与加州大学圣地亚哥分校研究发现现有世界模型会无视动作控制信号,根源是隐动作模型受视觉混杂因素污染。团队提出CD - LAM,从上游净化隐动作表征,实验显示其能降动作误差、提画面质量,降低后训练开销。

机器之心
算法论文8

别再用单选评测骗自己了!Amazon新论文揭示了大模型在多选题中的3种系统性偏差

Amazon新论文揭示大模型做多选题有3种系统性偏差,如选择、数量、猜测偏差。还推出SATA - Bench评测,给出10个测量指标,提出Choice Funnel解码策略,能提升小模型多选题正确率。

深度学习自然语言处理
开源动态8

18.2K Star!macOS 丝滑跑Linux,一键容器、多架构支持,开发效率直接起飞!

介绍轻量级虚拟机管理器 `Lima`,它能在 macOS 上提供类似 WSL2 的体验,专注容器化工作流。支持多架构与多驱动,有开箱即用的容器化支持等特性,安装和使用简单。

开源先锋
算法论文8

模型如何泛化出多智能体推理能力?清华提出策略游戏自博弈方案MARSHAL

近日,清华大学等机构研究团队提出 MARSHAL 框架,利用强化学习让大模型在策略游戏自博弈。实验表明,多轮、多智能体训练提升了模型博弈决策水平,将推理能力泛化到通用多智能体系统,在一般推理任务表现显著提升。

机器之心
新闻资讯7

亏到发疯!AI编程独角兽年入2亿8,结果用户越多亏得越狠

TechCrunch调查发现,AI编程公司虽收入和估值高,但普遍亏损。其运作成本高,大语言模型调用费占大头,用户越多成本越高,且市场竞争激烈。公司尝试自研模型、被收购、降价、提价等方法扭亏。

量子位