智元(Token)」共找到 1455 篇相关文章

新闻资讯7

2024车载激光雷达市场、技术和产品

国际权威研究机构Yole Group发布《Automotive LiDAR 2025 Market & Technology Report》,本文解读其关键内容,涵盖2024年车载激光雷达市场销量、份额、单价)、技术激光器、接收器、扫描部件)和产品车辆集成、长距雷达、短距雷达)情况。

芯师爷
开源动态8

给机器人一个会预测未来的Critic,VLA强化学习直接起飞

OpenMOSS团队开源的World Critic ModelWCM),解决了视觉 - 语言 - 动作模型强化学习VLA - RL)中批评家模型Critic Model)仅依赖单帧观测打分的问题。WCM让Critic学习预测执行动作后的潜在状态,代码等全开源,验证效果显著。

机器之心
算法论文8

Make SFT Great Again!从SFT到DFT:一权重之差,泛化之跃

大型语言模型的监督微调SFT)简单高效,但泛化能力弱于强化学习RL)。本文直击 SFT 核心缺陷,揭示其泛化瓶颈源于隐含的“病态奖励结构”,并提出仅需单行代码修改的动态微调DFT),实验表明其效果显著。

深度学习自然语言处理
算法论文8

阿里:RL强化LLM推理,是技巧还是陷阱?

近年来,强化学习RL)成为解锁大型语言模型LLM)复杂推理能力的关键工具,但该领域也面临技术选择困境。阿里联合多所高校的论文通过大规模可复现实验,揭示主流RL技巧的机制与适用场景,还发现极简组合Lite PPO)性能超越复杂方案。

深度学习自然语言处理
7

AI 写代码太烧钱了:Copilot、Claude 一起涨价,不如把程序员请回来?

GitHub和Anthropic几乎同时宣布调整AI写代码的计费模式,引发AI写代码成本是否会超雇程序员的讨论。AI公司前期以低价或免费扩张,如今将成本转嫁用户,但浪费严重,临界点临近。

AI前线
8

Transformer终结者!谷歌DeepMind全新MoR架构问世,新一代魔王来了

KAIST、谷歌DeepMind等机构发布的MoR架构,推理速度翻倍、内存减半,重塑LLM性能边界,碾压传统Transformer。它融合参数共享与按需计算,有路由和KV缓存策略,实验显示其性能优越、可扩展性好。

新智元
新闻资讯7

CNCF 警告:仅靠 Kubernetes 不足以保障 LLM 工作负载的安全性

云原生计算基金会CNCF)指出,企业在 Kubernetes 上部署大语言模型LLM)存在安全缺口。Kubernetes 无法理解或控制 AI 系统行为,需增加额外控制层,引入 AI 特定控制。

InfoQ
算法论文8

视觉模型既懂语义,又能还原细节,南洋理工&商汤提出棱镜假说

南洋理工与商汤团队提出 Prism Hypothesis棱镜假说)与 Unified AutoencodingUAE)。论文指出视觉基础模型中语义理解和像素保真很难兼得,用频率谱统一视角解决冲突,UAE 实验效果良好。

机器之心
推荐文章7

从Manus热潮看中国科技出海:新加坡能否成最佳首站?

AI Agent 公司 Manus 将总部迁至新加坡,凸显其优势。白鲸开源创始人郭炜分享中国科技企业出海经验,对比 A、B 路径,分析中美市场差异,探讨中国软件市场优劣势,还阐述开源商业化及新加坡作为出海首站的价值。

InfoQ
算法论文8

大模型顿悟原理!Meta新论文说清楚了

Meta超级智能实验室FAIR)最新论文把大模型顿悟grokking)现象的数学机制说清楚了。提出Li2数学框架,将两层神经网络的grokking动态分三阶段,还推导了泛化缩放定律等。

AI工程化