新能安」共找到 7818 篇相关文章

新闻资讯7

AI全的过去与未来:从大模型到智体 | 预约

业界提升前沿AI模型和智全性,常用全评测和‘全对齐’技术,但未真正解决风险。本次分享将介绍‘内生全’探索成果,还公布了相关论文信息,刘东瑞等嘉宾将参与。

深度学习自然语言处理
算法论文8

多模态推理范式!DiffThinker:用扩散模型「画」出推理和答案

上海人工智实验室等团队提出全生成式多模态推理范式,发布模型 DiffThinker。它打破传统定式,以图像到图像生成任务重构推理过程,在多项复杂任务中表现优于顶尖闭源模型,有四大核心特性。

机器之心
开源动态8

个人电脑也进行智体RL训练?尤佳轩团队开源OpenTinker

伊利诺伊大学厄巴纳 - 香槟分校尤佳轩团队开源OpenTinker,这是全‘强化学习即服务’系统。它通过解耦架构和友好API,让开发者在不同算力设备启动智体训练,解决传统RL框架难题,指明下一代智体基建方向。

机器之心
产品应用8

AI Coding王登场!MiniMax M2.1拿下多语言编程SOTA

MiniMax发布旗舰级Coding & Agent模型M2.1,在Multi - SWE - bench榜单中以10B激活参数拿下49.4%成绩,超越竞品成SOTA。它解决模型‘偏科’问题,适配开发工具链,实测在多语言编程任务中表现出色。

量子位
算法论文8

极简RL范式:一半算力刷1.5B模型推理SOTA

过去为提升中小参数量模型推理力,开发者构建复杂RL流水线。JustRL论文提出极简、单阶段、固定超参训练方案,在两主流1.5B模型上刷SOTA,节省2倍算力,消融实验还揭示部分技巧会致性退化。

深度学习自然语言处理
开源动态8

Svelte 团队成员开源框架 Ripple,又一个想“改写前端”的框架?

Ripple是全开源前端框架,由Svelte核心维护者打造,融合多框架理念,采用TS优先设计,有细粒度响应式机制等,目标是带来更简单开发体验,团队还探索集成AI力,目前处于早期阶段。

InfoQ
7

看懂这篇,你就秒懂 LLM底层秘密—Transformer原理解析

文章由浅入深介绍LLM基础知识,着重解析Transformer原理,结合案例讲解其工作流程,还介绍当前开源旗舰LLM架构变化,如DeepSeek V3等模型的创,最后强调模型力与应用形态的关系。

腾讯技术工程
新闻资讯7

腾讯胡文博:引领 3D 视频世界模型趋势丨GAIR 2025

2025年12月12 - 13日,第八届GAIR全球人工智与机器人大会将在深圳举办。腾讯ARC实验室高级研究员胡文博将在13日《世界模型》论坛分享《迈向三维感知的视频世界模型》。他深耕视频生成模型,成果显著。

AI科技评论
算法论文8

谢赛宁、李飞飞、LeCun联手提出多模态LLM范式,「空间超感知」登场

纽约大学助理教授谢赛宁与李飞飞、Yann LeCun 合作提出「Cambrian - S」,迈出视频空间超感知探索第一步。该研究引入 VSI - Super 基准,还提出预测性感知范式,在空间认知任务上有提升,相关论文值得视频多模态研究者参考。

机器之心
开源动态8

自回归科学基座模型 BigBang-Proton,提出实现 AGI 的路线

超对称公司发布自回归科学基座模型 BigBang - Proton,挑战主流 AGI 技术路线。它实现多学科问题与 LLM 统一预训练和推理,有三项创,在多专业任务表现出色,还提出宇宙尺度压缩构想。

AI科技大本营