「新能安」共找到 7878 篇相关文章
“客户测950,不到一周下单了”,DeepSeek V4 逼出昇腾真功夫
昇腾计算业务副总裁张良透露昇腾近期销量好、认可度提高,大量客户基于其做训练。DeepSeek V4 考验昇腾,其超节点产品均支持。昇腾还对芯片体系和软件栈升级,拒绝仿 CUDA,坚持自主构建生态。
刚刚,国产AI双冠王!黑马世界模型打破全球纪录,一镜到底封神
生数科技的MotuBrain零宣发登顶双榜,打通「看懂世界+执行行动」,适配多个头部机器人本体。它基于Motus进化,具备多本体、多任务、长程执行能力,展示出强大的「一脑多能」和「一脑多型」特点。
VEGA-3D:释放视频生成模型中的隐式3D知识,重塑3D场景理解与具身交互
华中科技大学与百度联合提出VEGA - 3D,释放视频生成模型隐式3D知识。它将视频生成模型作‘潜在世界模拟器’,用自适应门控融合机制,提升场景理解等任务表现,无需额外3D标注数据。
为了训练AI,Meta强制监控了员工的鼠标和键盘
近日,Meta宣布在美国员工电脑装追踪软件,记录鼠标、键盘操作及截取屏幕内容,用于训练AI。这引发员工愤怒,Meta CTO称员工无法退出。Meta AI投入大,此举或因缺训练数据,但也被质疑是在训练替代者。
Mythos架构被22岁小伙“逆推”开源了!MoE和注意力借鉴DeepSeek
22岁小伙Kye Gomez将Claude Mythos架构整合开源成OpenMythos,实现带MoE路由的循环深度Transformer(RDT)。该架构仅用一半参数,就能获与传统模型同等效果,吸引学界关注。
Claude Opus 4.7,全网差评!刚升级就翻车,用户怒斥:还我4.6
Claude Opus 4.7刚发布就遭全网吐槽,价格贵50%,性能却严重倒退,出现幻觉、计算拉胯等问题。用户质疑Anthropic为省钱缩水模型,罪魁祸首可能是新引入的“自适应推理”功能。
视频世界模型跑长序列不「崩」了!用光流约束+历史记忆+多步训练,让动态场景稳如磐石
现有视频世界模型在长时间交互中易出现运动不合理与场景崩坏问题,核心原因是误差累积。MagicWorld提出面向长时稳定性的交互式建模框架,通过光流约束、历史缓存检索和多步聚合训练,有效缓解误差累积。
在ICLR 2026主会之前,我们和30多位入选者聊了聊最前沿的AI细节
4月14日,智源社区、DeepTech联合举办ICLR 2026预讲会。会议聚焦顶会核心精华,三十余位论文作者分享AI Agent、大语言模型等热门领域成果,展示解决大模型痛点的研究。
首席工程师之路:培养领导力
Sophie Weston 在 QCon 伦敦大会演讲称,成为首席工程师不仅要技术能力,还需影响力等。工作外如体育运动等能提升领导潜力,还建议融入科技社区、公开演讲,这些效果会成倍增长。
谷歌DeepMind设立首个AI哲学家岗位,解决AGI伦理困境
谷歌DeepMind新设全职哲学家岗位,由剑桥学者Henry Shevlin出任。当下人们对AI恐惧渐入现实,而大众常用AI让AI意识成社会问题,这凸显了哲学家解决AGI伦理困境的必要性。