「新全栈」共找到 5148 篇相关文章
VAE时代终结?谢赛宁团队「RAE」登场,表征自编码器或成DiT训练新基石
纽约大学谢赛宁团队推出RAE替代VAE,解决了DiT依赖旧版SD - VAE的问题,如架构复杂、潜空间受限等。RAE结合预训练编码器和解码器,还提出DiT^DH变体,实验效果好,网友看好其前景。
浙大提出Translution:统一Self-attention和Convolution,ViT、GPT架构迎来新一轮性能突破
近日,浙大与新加坡国立大学提出新型深度神经网络基础操作Translution,融合Self - Attention与Convolution优势,实现二者统一。基于它构建的网络在ViT和GPT架构下性能提升,但对算力要求更高。
灵巧手能帮女友拧瓶盖了!同济清华上海交大等新成果 | CoRL 2025
来自多高校研究团队提出KineDex框架,以真·手把手指导方式让人类动作传至灵巧手,同步采集高保真触觉信息,使星动纪元灵巧手星动XHAND 1解锁复杂精细操作,论文已被CoRL 2025接收。
破解MoE模型“规模越大,效率越低”困境!中科院自动化所提出新框架
大模型参数量飙升却陷入‘规模越大,效率越低’困境,中科院自动化所研究团队提出统一框架,直击MoE底层运作模式,让专家‘组队学习’,实现参数量、负载方差降低,达成三重优化。
Figure三代机器人发布:洗衣洗碗家务全包!网友:非人形没有出路了
Figure发布第三代人形机器人Figure 03,专为适配Helix AI系统、贴合家庭场景打造。家务表现出色,CEO称无遥控。该公司发展迅猛,融资超10亿美元。Figure 03内外全面升级,为规模化生产设计,引发网友对人形机器人前景热议。
1亿签约金抢AI大神?谷歌AI元老劝退全网:别再读博了!
AI人才大战升级,Meta砸1亿美元挖OpenAI员工。谷歌元老Jad Tarifi警告,此时读博蹭AI热潮已晚,建议钻研AI+生物等新兴领域或远离。他还认为读博像赌博,社交与同理心等技能比学位重要。
又一推理新范式:将LLM自身视作「改进操作符」,突破长思维链极限
Meta等机构研究者将LLM视为「思维」改进操作符,探究并行 - 蒸馏 - 精炼(PDR)推理方法。实验显示,PDR在数学任务中提升准确率,还训练8B模型让推理方法更适配,减少训练与部署的不匹配。
开发者狂喜:Thinking Machines发布首款产品Tinker,后训练麻烦全给包了
OpenAI前CTO创办的Thinking Machines推出首款产品Tinker,这是用于微调语言模型的API,能简化LLM后训练过程,支持前沿模型,使用LoRA技术降低成本,还发布开源库,多高校团队已试用。
Java 30周年献礼:新LTS版本Java 25,服务器内存砍掉22%,AI开发起飞
2025年9月16日,Oracle推出Java 25,这是继JDK 21后首个LTS版本,官方提供八年支持。它含18个JDK增强提案,目标是优化AI运行、安全防护等,在省内存、提速度、简语法等方面均有显著改进。
刚刚,李飞飞空间智能新成果震撼问世!3D世界生成进入「无限探索」时代
斯坦福大学教授李飞飞创业公司 World Labs 发布限量开放测试预览版空间智能模型 Marble。输入单张图片或文本提示,它就能生成可无限探索的 3D 世界,与谷歌 Genie 有显著区别,还支持导出高斯点云等。