静态人物图」共找到 408 篇相关文章

算法论文8

AI看一本正经胡说八道?「一拉一推」让模型看得全又准|微软x清华

随着视觉 - 语言模型(VLM)推理能力增强,‘看错’问题凸显。现有方法有局限,微软亚洲研究院与清华提出BiPS,从训练阶段重塑模型‘看方式’,通过‘一拉一推’机制让模型‘看全又准’,实验效果显著。

量子位
新闻资讯7

刚刚,奥特曼发布GPT-5!人人免费用「博士级」智能,基准错误遭全网吐槽

OpenAI 发布 GPT - 5,奥特曼连发推文介绍看点。它是集成模型,有免费版、Plus 和 Pro 计划,多领域跑分亮眼。不过直播现小 bug,跑分出错,马斯克拆台,表现未达部分人预期。

机器之心
算法论文8

NUS LV Lab新作|FeRA:基于「频域能量」动态路由,打破扩散模型微调的静态瓶颈

在大模型时代,参数高效微调(PEFT)已成为迁移大规模扩散模型至下游任务的标准范式。但现有微调方法多采用「静态」策略,忽略扩散生成过程内在规律。新加坡国立大学LV Lab等机构提出FeRA框架,通过频域能量动态路由,实现高效微调。

机器之心
新闻资讯7

2025中国力学大会AI+分享 | 四川大学张来平研究员:基于神经网络的流场预测方法研究进展

2025中国力学大会AI+分享中,四川大学张来平研究员介绍基于神经网络的流场预测方法研究进展。张来平长期从事计算流体力学研究,近年专注AI for Science,成果颇丰。

力学与人工智能
推荐文章8

11篇顶会论文之外,美影像研究院做了一件事:让大众爱用AI

过去两年,AI 生成片、视频变得容易,但让 AI 理解并按创作者意创作很难。美影像研究院过去几年围绕高频创作场景痛点展开研究,11 篇论文被国际顶会接收,成果通过产品落地转化为 AI 影像能力。

机器之心
开源动态8

基础模型又一关键拼,腾讯混元发布训练新范式「无相」:引入功能性记忆,打破静态权重枷锁

腾讯混元团队发布HY - WU范式,打破静态权重束缚,引入功能性记忆,实时生成个性化参数。应用于形编辑基模效果好,在像编辑任务表现优秀,还对未来AI架构提出多方面展望。

量子位
产品应用7

给 AI 一张陶罐碎片,它能还原破裂过程吗?Minimax H3 vs Seedance 2.0 Fast 实测

文章实测 MiniMax H3 和 Seedance 2.0 Fast,给模型一张破碎陶罐,让其生成破碎过程视频。分析 H3 技术逻辑,对比两模型效率、质感和物理细节等差异,指出开放与闭源模型的特点及视频模型待解决的问题。

AI科技评论
算法论文8

因果发现大模型迎来「理论破局」: DAG-FM 破解异质机制下的因果识别与涌现难题 | GAIR Paper 116

浙大、清华与稳准智能联合发布因果发现大模型DAG - FM,解决了现有模型缺乏理论基础、易产生非法环路和显存爆炸问题。它在理论上证明因果可识别,架构上避免环路,处理数据能力强,还将推进特定领域预训练。

AI科技评论
开源动态8

SD又回来了!一秒出,手机就能玩:SD3.5-Flash让专业AI绘画进入“闪电”时代

Stability AI联合萨里大学SketchX实验室推出SD3.5-Flash模型,能在普通电脑甚至手机上快速生成专业级高分辨率片。它将推理步骤压缩、显存要求降低、出时间大幅缩短,画质也没明显缩水,还在性能上反超SD3.5M。

AIGC开放社区
开源动态8

5B参数+4060Ti,10秒出,全流程开源可复现!补齐统一多模态生成编辑的开源版,让高质量像生成真正变得更轻量、更普及

近日,多机构联合发布统一多模态生成编辑模型DeepGen 1.0,仅5B参数,集成五大能力,4060ti 16G上10秒出,多项指标超大4倍工业级模型。团队开源全流程代码与数据,可从零复现。

量子位