「自研模型」共找到 8402 篇相关文章

新闻资讯8

陈天桥旗下盛大AI东京研究院于SIGGRAPH Asia正式亮相,揭晓数字人和世界模型成果

在SIGGRAPH Asia 2025期间,盛大AI东京研究院首次公开亮相。当前数字人交互缺乏“灵魂”,存在长期记忆与人格一致性、多模态情感表达缺失和缺乏自主进化能力等问题。为此,研究院推出Mio框架解决挑战。

机器之心
算法论文8

VGGT4D:无需训练,挖掘3D基础模型潜力,实现4D动态场景重建

香港科技大学(广州)与地平线研究团队提出 VGGT4D,无需训练,通过挖掘 Visual Geometry Transformer 注意力层运动线索,在动态物体分割等任务表现优异,为 4D 重建提供新思路。

机器之心
新闻资讯7

烧3万亿美元实现ASI,把自己优化掉:这是硅谷CEO们的新赌注

硅谷大佬热衷预言AI接管公司,皮查伊称CEO工作AI易胜任,奥特曼想让OpenAI由AI掌管。但当下技术连自动售货机都难经营好,科技巨头豪掷3万亿,纳德拉却认为AI难掌管公司。

新智元
算法论文8

突破类脑模型性能瓶颈:校正频率偏置实现性能与能效双突破|NeurIPS 2025

香港科技大学(广州)等团队在NeurIPS 2025论文指出,脉冲神经网络(SNN)性能不佳根源是频率偏置,非二进制激活。团队提出Max - Former架构,校正频率偏置,实现性能与能效双突破,卷积架构也适用。

量子位
产品应用8

抛弃“级联”架构!快手OneRec用大模型重构推荐系统,服务成本降至1/10

传统级联式推荐架构有瓶颈,快手用OneRec重构推荐链路,服务成本降至1/10。文中介绍OneRec架构、Tokenizer方案、强化学习奖励设计,还提及优化及多模态联合训练方向。

InfoQ
产品应用8

英伟达祭出NVFP4核弹:大模型训练根本性转变,GB300效率狂飙7倍

英伟达推出新格式NVFP4,能以4 - Bit速度与效率实现16 - Bit生产件级训练精度,是LLM开发重大飞跃。虽处于研究阶段,但正与多组织合作。还介绍其方法、优势,实验也证明它在大规模训练的有效性。

AI寒武纪
算法论文8

ACL 2025杰出论文!用能力显著向量让大模型下游任务性能预测更精准

上海人工智能实验室与复旦大学联合研究成果《Capability Salience Vector》获ACL 2025杰出论文奖。提出能力显著向量(CSV)解决验证损失与下游任务能力脱节问题,实验验证其提升了下游任务表现可预测性。

OpenMMLab
新闻资讯7

核心模型被曝蒸馏DeepSeek?前女友一纸控诉,曝出欧版OpenAI塌房真相!

曾被誉为「欧洲OpenAI」的Mistral AI陷入「抄袭」丑闻。前员工在分手小作文爆料其核心技术蒸馏DeepSeek,却误导外界为自主RL成果。此前也有博主发现二者特征相似。蒸馏本身没错,缺乏透明度才是关键问题。

新智元
新闻资讯8

老黄自曝皮衣口袋藏“秘密期权池”!随时准备奖励员工,团队亿万富翁数量世界第一

黄仁勋在采访中透露随身带“秘密期权池”奖励员工,称团队亿万富翁数量世界第一。他还谈及人才市场、芯片分配、AI对就业和经济影响等,如认为收购公司不如付一人10亿,芯片分配先到先得等。

量子位
新闻资讯7

自曝曾想拆分英伟达,特朗普签署最激进「AI行动计划」,全行业去监管

当地时间本周三,特朗普签署三项行政命令、概述「人工智能行动计划」,含超90项政策行动,计划明年实施。该计划旨在消除监管、加快AI发展,还谈及拆分英伟达、放宽芯片出口等事。

机器之心