大模型数据」共找到 9999 篇相关文章

开源动态8

通义实验室火的 WebAgent 续作:全开源模型方案超过GPT4.1 , 收获开源SOTA

WebAgent续作《WebShaper: Agentically Data Synthesizing via Information-Seeking Formalization》提出对information-seeking任务形式化建模,设计训练数据合成方法,全开源模型方案在GAIA评测获SOTA表现,还补足了训练数据不足问题。

机器之心
新闻资讯7

爆冷!首届模型争霸,Grok 4下出「神之一手」?DeepSeek、Kimi惨遭淘汰

谷歌Kaggle举办首届全球AI象棋争霸赛,八款顶级语言模型正面对抗。首战8进4淘汰战中,Gemini 2.5 Pro、o4 - mini、Grok 4、o3晋级,Claude 4 Opus、DeepSeek R1、Gemini 2.5 Flash和Kimi K2出局。比赛考验AI整体理解能力。

新智元
算法论文8

上海交DENG Lab提出「LatentUM」:Unified Model的真正「战场」在视觉推理与世界模型

上海交通学 DENG Lab 提出的 LatentUM,尝试让统一模型把生成的视觉内容纳入推理闭环。它在多项任务上超越基线,其核心思路是生成与语言共享语义空间的离散 visual semantic tokens,模型含三关键设计。

机器之心
开源动态8

500行极简开源框架,硬刚GPT/Gemini视觉极限!

多模态模型代码能力进步,但基础视觉任务常失误。UniPat AI构建SWE-Vision框架,让模型用代码处理视觉判断,在五个视觉基准测试达最优,其极简设计有效且泛化性强,代码已开源。

新智元
新闻资讯7

阶跃星辰豪揽超50亿融资,“天才创始人”印奇重掌帅印

阶跃星辰完成超50亿人民币B+轮融资,刷新近12个月中国模型单笔融资纪录。同时印奇出任董事长。公司坚持“基础模型”与“AI+终端”战略,在多模态领域成果多,正推进商业化探索。

InfoQ
算法论文8

AI黑化如恶魔附体!LARGO攻心三步,潜意识种子瞬间开花 | NeurIPS 2025

在NeurIPS 2025,哥与罗格斯提出LARGO,它不改提问,直接在模型“潜意识”动手脚,绕过安全防护输出不该说的话。其分三步攻击,成功率高、隐蔽且迁移性强,暴露模型根本性弱点。

新智元
算法论文7

Talking-Critic奖励模型带来更自然的音频驱动肖像

近期音频驱动肖像动画技术发展快,但现有方法存在嘴型声音不对、动作不自然等问题。阿里提出Talking - Critic奖励模型,构建Talking - NSQ数据集,还提出TLPO优化框架,提升多维度表现,实验超现有SOTA方法。

带你学AI
算法论文8

ICCV 2025|降低扩散模型中的时空冗余,上交EEdit实现免训练图像编辑加速

上海交通学EPIC Lab团队提出EEdit框架,入选ICCV 2025。它是首个加速匹配流模型图像编辑框架,能兼容多种引导方案,免训练,速度较原始工作流快2.4倍,支持多类型编辑任务。

机器之心
算法论文8

首帧的真正秘密被揭开了:视频生成模型竟然把它当成「记忆体」

UMD、USC、MIT研究团队发现视频生成模型会把首帧当作‘概念记忆体’,将视觉实体存于首帧并在后续复用。基于此提出轻量方法FFGo,用少量例子让模型实现SOTA级视频定制。

机器之心
算法论文8

华为攻克AI推理「想太多」问题!新方法让模型推理提速60%,准确率还高了

华为提出高效推理方法S - GRPO,突破思维链「冗余思考」瓶颈。通过“串行分组 + 衰减奖励”设计,在Qwen3上有效,推理提速60%,生成答案更精确有用,在多个推理benchmark测评中表现出色。

量子位