「AI 模型构建」共找到 14049 篇相关文章

新闻资讯7

Yann LeCun 炮轰 Anthropic CEO!这人“既要又要”:要么太自大、要么不诚实

向来直言不讳的 Yann LeCun 将‘大炮’轰向了 Anthropic CEO Dario Amodei。Yann 认为 Amodei 作为‘AI 末日论者’却研究 AGI,要么学术不诚实,要么有优越感。而 Amodei 反对《HR1》法案,既肯定 AI 前景,也指出其社会风险。

AI前线
新闻资讯7

DeepSeek秘密造芯!专攻推理,一年前已启动,招聘全程不公开

路透社消息,凭借算法震动硅谷的中国AI公司DeepSeek正秘密开发自研AI芯片,定位推理,项目约一年前启动,现处早期。全球模型公司自研芯片成趋势,虽挑战大,但DeepSeek有资金支撑。

量子位
新闻资讯7

刚刚,Meta挖走OpenAI清华校友宋飏,任超级智能实验室研究负责人

本周四消息,原OpenAI战略探索团队负责人宋飏加入Meta,任新成立的Meta超级智能实验室研究负责人。今年6月起Meta开启AI人才争夺,已挖来至少11位顶尖人员,宋飏加入为其AI部门添活力。

机器之心
算法论文7

VaseVQA:考古领域实现专家级,诊断+补弱RL框架

在文化遗产与人工智能交叉领域,研究人员提出把大型多模态模型放于‘诊断—补弱—精细化评估’闭环训练,配套结构化评测基准,让模型在文化遗产领域接近专家级能力。介绍了技术步骤、数据基准及关键发现等。

新智元
新闻资讯8

摆脱遥控器,波士顿动力人形机器人,开始「长脑子」干活了

世界人形机器人运动会引发对人工遥控机器人的争议。波士顿动力与丰田研究院合作为 Atlas 开发大型行为模型,展示其自主收纳整理成果,模型构建有流程,成果显著,研发遵循三项核心原则。

机器之心
算法论文7

一段 signature,不仅撬开了 Opus 的隐藏推理,还让 Kimi、GLM 露出了"熟悉感"

研究者发现,将 Opus 等强模型返回的加密推理块交给同家族弱模型,弱模型可能转写出隐藏内容。如用 Haiku 读取 Opus 的加密信息。此外,公开的 Agent 轨迹存在隐私泄露风险,部分开源模型易受 Opus 风格影响。

深度学习自然语言处理
产品应用8

CUDA再见了!寒武纪亮出软件全家桶

在AI时代,竞争转向软件生态等综合实力。寒武纪亮出软件全家桶,其基础软件平台Cambricon NeuWare日趋成熟。在训推解决方案上成果显著,各组件如驱动、编译器等也有诸多优化和功能,加速产业智能化转型。

新智元
产品应用7

你的数字伴侣贝拉 (Bella),正在唤醒!

贝拉是数字伴侣种子,愿景是成用户持久个性化伙伴。早期通过轮播视频呈现,采用AI原生开发路径,分感知核心、生成式自我、主动式陪伴三阶段构建,目标是成为由AI驱动的生命体。

GitHubStore
新闻资讯8

刚刚,阿里CEO吴泳铭发布「ASI宣言」:超级智能才是终局!

阿里巴巴CEO吴泳铭发布「ASI宣言」,认为AGI仅是序章,ASI才是终局。阿里云有两大战略路径,通义千问家族模型性能提升,如Qwen3 - Max超越GPT - 5,各模型在不同领域有出色表现。

新智元
算法论文8

GRPO训练不再「自嗨」!快手可灵 x 中山大学推出「GRPO卫兵」,显著缓解视觉生成过优化

GRPO在视觉生成流模型后训练阶段有显著提升,但clip机制存在系统性偏差,易使模型陷入过度优化。中山大学、快手可灵等团队提出GRPO - Guard,能降低过度优化风险,在多种任务中表现良好。

机器之心