「ERNIE-4.5-0.3B」共找到 4888 篇相关文章
MiniMax秀了波AI视频杂技:越看越惊艳,指令遵循太强了
MiniMax发布海螺2.0版本,能处理极端物理情况,原生支持1080P,在指令遵循、生成质量达一流水平,成本效率破纪录。此前还开源MiniMax - M1,两大底层技术创新让其成果惊艳,展现研发实力。
阿里搞了个全能解析器,文档、图片、音频、视频一锅端
阿里巴巴开源 Logics-Parsing-Omni,用一个模型统一处理文档、图片、音频、视频四种模态,输出结构化 JSON 数据。它采用三级渐进解析框架,两阶段训练策略,在自建基准上多项指标超越 Gemini - 3 - Pro。
大象秒变挖掘机!三维变形新突破,无需额外训练 | CVPR'26
南京大学与北京大学提出MorphAny3D,无需额外训练即可让三维生成模型实现跨类别平滑变形。它通过创新注意力机制融合源与目标特征,精准控制结构与时序,效果远超传统方法,代码已开源。
情人节最硬核“Kiss”!中国AI突破300年亲吻数难题,连刷多维度纪录
中国AI打破300多年的亲吻数难题。上海科学智能研究院等团队提出PackingStar系统,刷新多维度世界纪录。它将难题转化为多智能体博弈,成果获高度评价,还体现了AI for Science 2.0特质。
Anthropic最新2026趋势报告:人类最大一次编程革命势不可挡
Anthropic发布《2026年智能体编码趋势报告》,指出编程规则改变,任何人都能成开发者。报告给出8大趋势,如软件开发生命周期剧变、智能体能力提升等,还给出2026年组织需关注的4大领域。
英伟达开源全新大模型:黄仁勋不想只「卖铲子」
2025年底英伟达宣布开源全新模型家族Nemotron 3,含Nano、Super和Ultra。它融合Mamba、Transformer和MoE技术,有诸多创新。这不仅是产品更新,更是战略突袭,标志着英伟达想构建AI闭环开放生态。
图像编辑缺训练数据?直接从视频中取材,仅用1%训练数据实现近SOTA效果
百度研究人员提出将图像编辑视为退化的时间过程,Video4Edit利用视频预训练模型知识迁移,仅用主流编辑模型约1%监督数据,在图像编辑任务达近SOTA效果,解决数据稀缺与权衡难题。
“电子黄金”价格暴涨,雷军都顶不住了
近期内存价格暴涨,被称为“电子黄金”。雷军称内存涨价太多,其原因是AI巨头对存储需求挤占产能。中芯国际判断供应缺口超5%,高价会持续。产业链各环节受影响,还出现新技术HBF。
Proactor AI:首个自主行动的AI 智能体,无需唤醒,就能主动识别对面是个骗子
Proactor AI v1.0发布,号称是世界首个「自主行动」的AI队友。它能感知、思考并自主行动,如识别骗局。还提供主动式AI服务,应用场景广泛,用户反响热烈,带来人机交互范式转变。
刚刚,全网最猛AI视频模型免费了!我们手搓了一段「牛来」,效果绝了
AI短剧火爆,但创作者面临成本高痛点。Agnes Video 2.5系列模型上线Pavo平台,成本低效果好,其Flash版免费。Pavo还有「无限画布」和「Agent创作模式」,降低返工成本,实现低门槛创作。