大模型V4」共找到 9311 篇相关文章

新闻资讯8

清华2年前预言,正成为全球共识!Meta等三AI机构已得出同一结论

全球三家AI研究机构结论曲线斜率几乎重合,而中国面壁智能和清华联合团队两年前提出的“密度定律”与它们一致。该定律改写行业假设,如推理成本下降、端侧智能爆发临近、模型策略反转等。

新智元
开源动态8

谷歌痛失王座?港科贾佳亚团队DreamOmni2开源,超强P图暴击Nano Banana

港科贾佳亚团队开源DreamOmni2,该模型基于FLUX Kontext,能处理多参考图像,在多模态编辑与生成上表现出色,超越谷歌Nano Banana等模型,还构建了新测试集与数据构建范式。

新智元
新闻资讯8

小米神操作!认领榜一神秘模型Hunter Alpha,龙虾之父都忍不住打听

小米官宣MiMo-V2家族三款新模型Pro、Omni和TTS,其中Pro就是此前占领OpenRouter调用量榜单第一的神秘模型Hunter Alpha。它参数规模万亿,性能亮眼,Omni和TTS也实力强悍,此前身份引发全球网友好奇。

量子位
产品应用7

突袭Cursor,Windsurf抢发自研模型!性能比肩Claude 3.5、但成本更低,网友好评:响应快、不废话

当地时间5月16日,Windsurf推出首个AI软件工程模型家族SWE - 1,含三款模型,性能比肩Claude 3.5且成本更低。开发者试用评价不错,但也指出不足。Windsurf称旨在提升软件开发速度,还介绍了测评、编辑器赋能等情况。

AI前线
算法论文8

Meta&UIUC发现:无需标注,Agent复杂的工具使用和搜索能力,是可以“无中生有”的

Meta和UIUC研究发现,无需标注,Agent复杂工具使用和搜索能力可“无中生有”。论文Dr. Zero让模型自我博弈成搜索专家,用HRPO提效,设计难度导向奖励,实验表现佳,但也存在局限。

深度学习自然语言处理
开源动态8

GLM4.5之后,智谱又开源GLM-4.5V,实测下来视觉推理能力贼强~

智谱继GLM4.5后又开源GLM - 4.5V,它是同级别开源SOTA视觉推理模型,在多模态理解榜单表现优异。文章实测其在科研全生命周期的应用,还介绍了模型架构设计和训练策略。

PaperAgent
开源动态7

4.5k星星爆火!用图片压缩Fable 5上下文,成本幅降低,终于用得起这个模型

Fable 5在AI圈爆火,但使用成本比其他型号贵至少5倍。pxpipe项目把适合压缩的段文本渲染成PNG图片,交给多模态模型读取,能幅降低成本,还能增加上下文长度。

开源AI项目落地
开源动态8

蚂蚁专用模型超越o3!仅用2K训练样本刷新医疗AI榜单纪录

蚂蚁集团联合团队发布《MedResearcher-R1: Expert-Level Medical Deep Researcher》报告,其医学AI智能体MedResearcher-R1用2100条训练样本在医疗基准测试反超通用模型,靠数据、工具、训练方法三创新实现突破。

量子位
开源动态8

LeCun世界模型出2代了!62小时搞定机器人训练,开启物理推理新时代

Meta开源发布V-JEPA 2世界模型,图灵奖得主Yann LeCun称其将为机器人技术带来新时代。该模型能理解物理世界,经训练后在多方面表现优异,Meta还发布新基准测试,也透露了后续计划。

量子位
算法论文8

数据科学新风口?三环节搞定ML「资产」管理,VLDB'25最新教程抢先看!

模型时代,ML资产爆炸式增长,但多缺乏规范管理。凯斯西储学等研究团队将在VLDB 2025提出教程,从整理、发现、利用三环节给出ML资产管理方法论与系统路径,还会展示前沿平台解决实际问题。

新智元