自研模型」共找到 8207 篇相关文章

算法论文8

用155万模拟视频给模型上课!GVE模型一次学会9种视频检索技能

当前视频检索究陷入困境,现有模型难以应对复杂检索需求。香港科技大学(广州)联合阿里巴巴通义实验室推出通用视频嵌入模型GVE,其在零样本设置下超越14个主流模型,全链条创新为视频检索通用化奠定基础。

量子位
新闻资讯8

30人团队震撼英伟达!Jim Fan曝三个教训,重押世界模型

英伟达Jim Fan带队创立GEAR实验室,30人团队产出惊人,涵盖机器人学习完整技术栈。团队有GR00T基础模型等成果,Jim Fan还分享三个教训,重注视频世界模型,提出仿真世界三阶段,指出物理AI未来是新基础设施。

新智元
算法论文7

700多个「坏模型」喂出AI测谎仪?Anthropic审计神器让AI曝黑料

Anthropic故意训练近700个「有问题」模型,训了LoRA适配器(IA)让模型报家门。IA在AuditBench平均成功率59%,但也存在幻觉、成本高、训练分布无指南等局限。

新智元
算法论文8

MSRA清北推出强化预训练!取代传统监督,14B模型媲美32B

微软亚洲究院联合清北提出全新预训练范式RPT,将强化学习融入预训练,把预训练语料库重构为推理问题集。实验显示RPT-14B表现出色,在多方面媲美甚至超越32B模型,未来RL或在LLM预训练掀起风暴。

量子位
开源动态8

图像编辑太慢太粗糙?全新开源回归模型实现精准秒级修改 | 智象未来

AI图像编辑中扩散模型有两大难题,智象未来团队提出全新回归图像编辑框架VAREdit,引入视觉回归架构,提升编辑精准度与速度。模型和代码已开源,还提出SAR模块优化,在基准测试表现出色。

量子位
算法论文8

ERNIE 5.0:走向原生统一的万亿参数多模态基础模型

过去多模态模型‘拼接式’方案存在理解与生成割裂问题,ERNIE 5.0 借此提出,用统一回归框架做多模态理解与生成,在架构、训练与系统层面有创新,评测中各模态能力表现出色。

深度学习自然语言处理
开源动态8

小扎又开源了:7B实现监督学习SOTA

Meta发布全新开源视觉模型DINOv3,首次证明监督学习模型能在广泛任务中超越弱监督学习模型。它用无标注方法,扩展数据和模型规模,支持标注稀缺场景,在多任务实现SOTA。

量子位
算法论文7

苹果港大终结回归时代?7B扩散模型发布,AI写代码逻辑彻底颠覆!

苹果联合港大开源扩散大语言模型DiffuCoder,用扩散模型+强化学习策略,性能提升4.4%。究还提出耦合梯度奖励策略优化方法,建立原生RL训练框架,探究了dLLM的生成机制等问题。

新智元
开源动态7

NextStep-1:一次在图像生成上回归范式的探索

阶跃星辰团队探索回归图像生成新路径,推出 NextStep-1。它直接在连续视觉空间回归生成,架构简洁,实现端到端训练。模型有高保真生成和编辑能力,Benchmark 表现佳,但也面临稳定性等挑战。

机器之心
算法论文8

速度提升,能力却暴跌?扩散模型做智能体的残酷真相

南洋理工大学陶大程教授团队联合发布评测报告,揭示扩散语言模型在智能体能力上有系统性缺陷,落后回归模型。还分析其失败原因,提出评测框架,明确能力边界并给出究建议。

机器之心