新能安」共找到 7855 篇相关文章

算法论文7

震撼实锤!清华姚班校友揭「1.4×加速」陷阱:AI优化器为何名不符实?

为降低大模型预训练成本,近年优化器频出,宣称加速1.4×到2×却难落地。斯坦福研究指出方法学缺陷,对比不同缩放范式加速差异,给出优化器设计见解,证实严格基准评测必要。

新智元
算法论文8

“掩码即武器”,四款扩散LLM全部破防 ? 上交&上海AI Lab发现dllm致命全缺陷

上海交通大学、上海人工智实验室等团队研究指出,扩散语言模型(dLLMs)有根本性架构全缺陷。他们提出DIJA攻击框架,让多个dLLMs大概率生成有害内容,还呼吁从多方面加强dLLM全。

深度学习自然语言处理
开源动态8

阿里开源创AI Agent:媲美Deep Research,Github每日增长第一

人类信息检索力受限,OpenAI的Deep Research虽解决难题但闭源。阿里巴巴通义实验室开源AI Agent框架WebSailor,在多基准测试表现出色,核心技术围绕复杂任务生成和强化学习模块展开,在Github成绩亮眼。

AIGC开放社区
算法论文8

为大模型思考装上“猎鹰重装引擎” :腾讯混元 SEAT 重塑深度思考

本文深度解析腾讯混元最发布的 SEAT 自适应并行扩展推理框架。它让大模型 CoT 升级,应对复杂推理任务。该框架通过多轮并行推理和语义熵导航,解决大模型深度思考的局限,且适配多种大模型,性价比高。

AI科技大本营
开源动态8

大模型首次直接理解代码图:不用Agent自动修bug,登顶SWE-Bench开源模型榜单

蚂蚁开源模型CGM,首创将仓库代码图模态融入大模型,不依赖闭源模型和复杂Agent,仅需4步就快速定位、生成补丁。它在多个测试基准中领先,技术论文等均已开源。

量子位
算法论文7

英伟达发现RL Scaling!创造力暴涨,做基座模型做不了的事!

过去学界争论强化学习(RL)对语言模型的作用,此前研究认为其效果有限。本文发现问题出在训练时间短,提出ProRL,让训练突破2000步以上,结果惊人,小模型也有出色表现。

深度学习自然语言处理
产品应用8

RoboScience机器科学发布轮式仿人形通用机器人REX G1,让机器人真正成为一代具身生产力伙伴|甲子光年

8月17日,RoboScience机器科学发布轮式仿人形通用操作机器人REX G1,搭载自研的Visics通用具身大模型,面向多场景打造,完成完整任务闭环。它将移动与操作融合,适应真实环境,具强大泛化力且续航佳。

甲子光年
推荐文章8

Anthropic 的 Harness 哲学:把 Agent 当牲口,而非宠物

本文分享Anthropic最两篇博客,介绍其将运维圈“宠物 vs 牲口”哲学用于AI Agent架构设计。旧架构如“宠物”易出问题,架构脑手分离,把Harness做成可随时重启的“牲口”,降低延迟、提升全,还提出信任框架。

AGI Hunt
新闻资讯7

马斯克冲刺机器人量产,果断停产特斯拉豪华车型!2026年资本支出将“非常大”

在最财报电话会议上,马斯克宣布特斯拉2026年第二季度停产豪华车型Model S和Model X,为擎天柱机器人让出生产线,还将投资20亿美元给xAI,今年资本支出或超200亿美元。此外,Neuralink也有进展。

量子位
新闻资讯8

首个智体商业信任协议来了!支付宝携手千问 App、淘宝闪购等发布 AI 商业协议 ACT

1 月 16 日,支付宝联合千问 App 等伙伴发布 ACT 协议,它是中国首个面向 Agent 商业需求的开放技术协议。该协议打造 AI 与服务平台‘通用语言’,解决授权、全等问题,让操作更放心,还降低商家对接成本。

InfoQ