波浪能」共找到 5046 篇相关文章

算法论文8

上海AI Lab新研究:SFT泛化,只要满足这三个条件

上海人工智实验室等团队研究指出,“SFT泛化力差”定论有局限。SFT泛化力受优化过程、数据质量与结构、模型基础力共同制约,研究还揭示其训练中的现象及副作用。

量子位
新闻资讯7

Mythos:普通人自由使用旗舰 AI 的时代,可要结束了

两天前,Anthropic 发布最强模型 Claude Mythos Preview,各方位性超 Opus 4.6 模型,却不公开发布,只面向少数合作方开放。这或预示普通人自由用旗舰 AI 的时代将结束,引发对 AI 未来商业与使用模式的思考。

Founder Park
算法论文8

CVPR 2026|DROID-W:复杂室外动态场景,也稳定SLAM

苏黎世联邦理工与微软团队提出 DROID - W 动态 SLAM 框架,即将发表于 CVPR 2026。它不预设动态物体,从多视角观测识别不可靠区域,还提出交替优化方案,在多个数据集表现优。

机器之心
新闻资讯7

鼠标点3下就锁定打击?五角大楼曝光美军AI大脑

美国国防部首席数字与人工智官Cameron Stanley演示Maven系统,将美军杀伤链从小时压缩到分钟。Maven整合多系统,Palantir的AIP嵌入大模型改变战争决策逻辑。Anthropic因坚守安全红线与五角大楼冲突。

新智元
产品应用7

Legora、Mercor 都在用,Reducto 成为独立的 LLM 数据入口吗?

当前企业AI落地瓶颈在数据质量,Reducto聚焦数据准确性,以文档解析API提供Agentic OCR力。它获多轮融资,估值达6亿美元,但面临多模态模型竞争及定价等问题,其未来走向待察。

海外独角兽
开源动态8

测试时也RL,英伟达等提出全新范式:TTT-Discover

近日,斯坦福、英伟达、Together AI 等联合开源全新测试时新范式 TTT - Discover,在测试阶段用强化学习微调模型,以刷出 single best 结果,用几百美元就刷新诸多领域 SOTA。

PaperAgent
开源动态8

个人电脑也进行智体RL训练?尤佳轩团队开源OpenTinker

伊利诺伊大学厄巴纳 - 香槟分校尤佳轩团队开源OpenTinker,这是全新‘强化学习即服务’系统。它通过解耦架构和友好API,让开发者在不同算力设备启动智体训练,解决传统RL框架难题,指明下一代智体基建方向。

机器之心
7

看懂这篇,你就秒懂 LLM底层秘密—Transformer原理解析

文章由浅入深介绍LLM基础知识,着重解析Transformer原理,结合案例讲解其工作流程,还介绍当前开源旗舰LLM架构变化,如DeepSeek V3等模型的创新,最后强调模型力与应用形态的关系。

腾讯技术工程
推荐文章7

舍弃 VAE,预训练语义编码器让 Diffusion 走得更远吗?

纽约大学谢赛宁团队、清华&快手 Kling 团队的研究者指出 VAE 制约当前 Diffusion 范式,提出用预训练视觉模型作语义编码器改进。介绍了 VAE 不足及 RAE、SVG 工作如何解决问题,将扩散模型从‘压缩优先’转为‘语义优先’。

机器之心
新闻资讯8

懂孩子、懂爸妈、还懂宠物,这届AI硬件太会了

在AI终端生态大会上,荣耀携手伙伴展示AI新用法,发布八大AI场景化生态解决方案,覆盖多高频场景。其构建的AI生态网让AI从‘用’到‘好用’,还重新定义硬件与人的关系,让AI更懂生活。

量子位