科研新范式」共找到 4297 篇相关文章

算法论文8

字节Seed作:模型合并如何改变大模型预训练范式

字节跳动Seed团队在arXiv发表论文,提出预训练模型平均(PMA)技术。该技术将模型合并引入预训练阶段,可提升性能、预测衰减阶段表现,还能解决训练问题。不过,高学习率影响和强化学习应用待研究。

机器之心
新闻资讯8

中国科幻大会聚合力 铸就首钢园未来产业高地

2026第十届中国科幻大会3月27日开幕,这是该盛会第六次落地首钢园。自2020年结缘,首钢未来数字空间创高地渐成实景。首钢聚焦科幻等质生产力领域,构建多元体验矩阵,以“会”聚产,推动科幻产业生态繁荣发展。

首钢园
产品应用8

超越Runway!Adobe发布神器:P视频比P图还简单

Adobe联合多高校推出AI模型EditVerse,它将图片和视频编辑整合,解决传统视频编辑复杂、数据稀缺问题。通过通用视觉语言、上下文学习能力和知识迁移,其效果超Runway,还展现涌现能力。

新智元
新闻资讯8

阿里一口气发了N款模型,让我们向源神致敬。

阿里云栖大会发布众多模型,有Qwen3 - Max、Wan2.5等。Qwen3 - Max对标顶尖模型;Wan2.5支持音画同出;Qwen3 - VL是强大视觉语言模型且已开源;Qwen3 - Omni是全模态模型。此外还有多个模型,构建全场景生态。

开源星探
开源动态8

开源不到一天1.9k星星!NVIDIA突破,机器人ChatGPT时刻!

NVIDIA开源ProtoMotions3框架,用经典自回归预测和物理仿真,让高级行为涌现。它能助力机器人多方面学习,有望降低人形机器人开发门槛,虽处研究阶段,但提出思路。

GitHubStore
新闻资讯7

清华艺博展|具身之路:机器如何成为“人”

清华艺博将举办“具身之路:机器如何成为‘人’”展览,时间为2026年4月30日 - 5月6日。展览以“启思—看透—看懂—共创”为动线,呈现人形机器人发展历程,探讨智能与身体关系及人机共在问题。

北京漫游指南
8

CUDA 20年护城河一个周末崩了 !Claude独自跑通AMDGPU

一个周末,Claude直接把自家最前沿模型跑在全AMD MI355X机架,人类工程师没改一行代码。AMD还给AI开发调GPU的工具,ROCm.AI可让Agent自己部署操作。Agent补生态积累短板,对CUDA生态形成降维打击。

新智元
新闻资讯8

马斯克公布SpaceX火星计划,迈向多行星生命之路!

马斯克在德州Starbase公布SpaceX火星最计划,介绍从Starbase发展、星舰生产目标、技术突破到火星城市建设等多方面内容,展示人类成多行星物种的清晰路线,还提及火星时间表等信息。

AGI Hunt
推荐文章8

刚刚,翁荔博客又上:通过Harness工程实现AI自我提升

翁荔博客聚焦Harness Engineering,梳理围绕‘Harness自我优化’的研究,探讨递归式自我提升发生层面,还指出自动化研究和自我提升系统面临的瓶颈,如评估标准模糊、奖励作弊等。

机器之心
算法论文8

Kimi论文太硬核了!马斯克和Karpathy相继点赞~

马斯克和Karpathy点赞Kimi论文《Attention Residuals》。该论文由杨植麟带队、苏剑林等参与,提出注意力残差(AttnRes),解决深层网络信息稀释问题,还通过工程折中降低成本,实验效果良好。

PaperAgent