「多场景预测」共找到 5625 篇相关文章
CVPR 2026 | 20步也能稳住画质,这个扩散加速方法不一样
扩散模型推理效率是落地应用的核心制约因素,阿里安全 AGI 实验室 - 御风大模型团队联合浙江大学提出全新扩散加速方法 TC - Padé,在低步数设置下能兼顾生成质量与推理效率,已被 CVPR 2026 录用。
企业级AI Coding的落地方法,都在这本实战手册里了|甲子光年
春节后字节上线TRAE企业版SOLO模式,发布《2026企业级AI编程实践手册》。TRAE企业版SOLO模式有自主规划、工具集成、多任务并行等能力。手册沉淀字节经验,提供方法论和场景实践,助企业迈入AI原生软件工程时代。
华为重金押注的世界模型公司,新融了10个亿!
具身基模和通用机器人企业极佳视界完成近10亿元Pre - B轮融资。其具身基模全球领先,国内首家布局世界模型,原生本体开启量产,在多场景有开创性应用,获产业巨头和顶尖资本认可。
大模型的第一性原理:(三)信息论篇
本文从信息论角度解读大模型第一性原理。介绍Shannon信息论,提出将其从以BIT为中心转换为以TOKEN为中心解释大模型底层原理,还阐述大模型各阶段信息论原理、定向信息计算方法,对比Granger与Pearl因果。
内存一年疯涨170%,云账单里的“隐性成本”该算清了
2025年下半年存储价格成焦点,DRAM合同价同比涨幅达171.8%,致企业IT采购成本上升。华为云更新Flexus云服务器系列,基于柔性算力技术,打破CPU与内存固定绑定,减少浪费,还引入应用级加速,提升性能。
下一代目标检测模型:3B参数MLLM Rex-Omni首度超越Grounding DINO,统一10+视觉任务
IDEA研究院团队用3B参数的Rex - Omni打破MLLM目标定位精度僵局。它统一视觉任务,结合坐标编码与强化学习,在多项检测基准超Grounding DINO等,解决定位和行为缺陷,为MLLM成下一代检测模型提供方案。
智谱开源GLM-4.5工具调用超越Claude Opus 4.1,成本仅1.4%
开源模型GLM-4.5在伯克利工具使用榜单上超越Claude Opus 4.1,运行相同任务成本仅为1.4%。它采用MoE架构,在多场景表现卓越,推理速度快,成本低,还接入多款主流编程工具。
李飞飞押注的「世界模型」,中国自研Matrix-3D已抢先实现了?
中国自研世界模型Matrix-3D可单张图生成3D世界,效果对标李飞飞的World Labs,还能实现更大范围探索。它有诸多优势,技术上有创新,数据集有特点,应用前景广泛。
具身智能猛将再狂揽近6亿融资!机器人Moz1卷入办公室,全力冲刺万亿赛道
2025年具身智能赛道爆发,全球科技巨头与初创公司竞技。千寻智能获近6亿PreA+轮融资,其商用机器人Moz1实力强,自研Spirit v1与OneTwoVLA模型表现出色,以独特商业策略布局万亿市场。
清华-腾讯联手:音频 - 视觉多模态任务统一框架
Crab是人大、清华和腾讯合作论文提出的模型,目标是高效一统多模态场景理解任务。它解决了音频 - 视觉理解模型任务干扰、合作显式化不足等难点,通过构建数据集、设计结构和统一架构实现多任务合作。