混元3D 2.1」共找到 3792 篇相关文章

产品应用7

Cursor 2.0 来了!自研模型 Composer1,更禅的界面,多代理并行,Browser调试更强大

Cursor 2.0 发布,有诸多升级。它有自研编码模型 Composer1,速度快且适合 Agent 模式;界面更清爽禅意;支持多代理并行,能提升编码效率;浏览器可嵌入编辑器,沙盒终端在 macOS 正式发布等。

AI进修生
开源动态8

3D开源端到端全景深度估计器,代码+精选全景数据已上线,在线可玩

全景深度估计在3D视觉领域日益受关注,但因全景数据稀缺、球面畸变问题,以往方法零样本泛化和效率不佳。腾讯3D团队提出DA²,通过数据扩充引擎和SphereViT架构,提升性能,展现SOTA表现。

量子位
算法论文8

Loss收敛不代表学会:腾讯ACL 2026拆解SFT训练中15.3%的“假学会”样本

大模型微调(SFT)是主流LLM落地方案,但大家默认训练完就是学完了。腾讯团队发现SFT存在不完全学习现象(ILP),论文完成了定义ILP、找根因、提诊断框架和验证干预等工作。

量子位
算法论文8

解码提速15.1倍、多任务性能不降:复旦&引望WAM-Diff2打通自动驾驶VLA自回归—扩散转换

视觉-语言-动作(VLA)模型是端到端自动驾驶主流技术,但自回归解码架构有瓶颈。复旦大学与引望智能联合提出WAM-Diff2,实现自回归VLA向离散扩散模型迁移,解码加速15.1倍,多任务性能不降。

机器之心
开源动态8

开源PhoneBuddy-4B与5篇系列论文:多项手机Agent真机评测超过GPT-5.4

腾讯Phone - use Agent团队发布PhoneBuddy - 4B及5篇系列论文。研究探讨如何训练真实可用的Phone - use Agent,采用Real + Mock方式,实验显示该方法提升效果显著,4B模型多项任务超GPT - 5.4。

量子位
新闻资讯8

港股AGI第一股“云知声”首战告捷:大模型贡献1亿收入,单客价直线提升116.2%,AI保险业务暴涨1386.8%

云知声发布《2025中期业绩报告》,亮点颇多。总收入4.05亿,同比增20.2%,山海大模型收入近1亿,增幅457%。业务布局呼应国务院‘人工智能+’行动,技术优势明显,展现了AI产业化落地的成功模式。

量子位
开源动态8

全新稀疏注意力优化!腾讯最新超轻量视频生成模型HunyuanVideo 1.5核心技术解密

腾讯大模型团队发布并开源轻量级视频生成模型HunyuanVideo 1.5,参数8.3B,支持5 - 10秒高清视频生成。它通过多层次技术创新,在生成效果、性能与尺寸上实现平衡,还具备多种核心能力。

量子位
产品应用8

中文版Nano Banana来了?Qwen-Image-2.0炸场:1K长文本硬吃,中文生图彻底不拧巴了

AI生图曾有文本长易糊、指令复杂就出错、中文渲染差等问题。阿里新发布的Qwen-Image-2.0能处理1K token长文本,理解复杂指令,中文渲染佳,还能多图编辑,国际评测表现也靠前,阿里云百炼已开通API邀测。

量子位
产品应用8

一夜暴涨至2100亿!开源新王MiniMax M2.5,革了Opus 4.6的命

新智报道,国产AI春节档,MiniMax M2.5昨夜登场,今日市值涨至2108亿港。其编码性能逼平Claude Opus 4.6,价格仅为1/20,适配开发者工具,在办公、深度研究等场景表现出色,基于Agent RL技术体系。

新智元
开源动态8

腾讯AngelSlim升级,首个集LLM、VLM及语音多模态为一体的投机采样训练框架,推理速度飙升1.8倍

随着大模型应用成本与延迟问题凸显,腾讯升级 AngelSlim 训练框架,将投机采样技术拓展至全模态场景。它以 Eagle3 架构让推理速度最高飙升 1.9 倍,还具全模态训练、面向部署等亮点,有开源代码。

机器之心