哥大团队」共找到 7277 篇相关文章

新闻资讯8

DeepSeek-R1登顶Nature,8位专家严审通过, 模型「交卷时刻」来了

近日,DeepSeek - R1登上Nature封面,打破主流模型未经过独立同行评审惯例。同行评审可理清模型机制,提升透明度与可信度,还能避免‘刷榜’‘自评’,虽有公司担心泄密,但它是验证成果的必要程序。

新智元
新闻资讯8

啊?微博7800美元训的模型,数学能力超了DeepSeek-R1

近日,微博发布自研开源模型VibeThinker,15亿参数却在数学测试上击败6710亿参数的DeepSeek R1,后训练成本仅7800美元。其为AI产业带来新思考,还将推动微博AI应用发展。

量子位
算法论文8

VLM剪枝新SOTA:无需重训练,注意力去偏置超越6主流方案

常用的attention机制存在位置偏置和padding异常,影响剪枝效果。上海学曾丹团队提出无需重新训练的attention去偏方法,在多模型、剪枝策略及基准上验证有效,为多模态模型部署提供新思路。

新智元
新闻资讯7

“像把象塞进冰箱一样困难”,端侧模型是噱头还是未来?

InfoQ《极客有约》X AICon 直播聚焦端侧模型,探讨其落地挑战与破局思路。专家指出端侧部署有隐私、可用性等优势,但面临内存、精度等难题。华为、支付宝等分享方案,还探讨应用场景、商业模式及未来趋势。

InfoQ
新闻资讯8

Neuralink更新!马斯克再次开启科技狂人模式:意念操控擎天柱,2026年治愈失明

马斯克带领Neuralink团队开近1小时发布会,亮点颇多。如可用Neuralink芯片意念操控擎天柱,研发“盲视”项目助失明者重见。还宣布已为七人植入设备,规划未来发展路径,展示临床成果。

AI寒武纪
开源动态8

击败 GPT-5!理想汽车开源 RubricHub:模型开放生成从此有了专业裁判

理想汽车基座模型团队联合高校发布RubricHub数据集,解决开放式任务评价难题。该数据集可将主观评价转化为量化标准,经其训练的Qwen3 - 14B小模型在医疗基准测试中超越GPT - 5。

AI科技评论
算法论文8

NIPS2025|小红书智创AIGC团队提出布局控制生成新算法InstanceAssemble

当下文本生成图像扩散模型有进展,但现有布局到图像生成方法在复杂场景表现不佳。小红书智创AIGC团队提出InstanceAssemble框架,从架构和评测应对难题,实现复杂布局下精确图像生成,有广阔应用潜力。

机器之心
算法论文7

模型在具身推理上「翻车」了?4496 道题全面揭示短板

美国东北学等提出BEAR基准评估MLLM具身智能子能力,用4496道题测试20个模型。发现多模态模型具身能力不足,还分析错因,开发BEAR - Agent提升模型具身推理能力,在仿真测试中效果显著。

机器之心
算法论文8

10行代码,AIME24/25提高15%!揭秘模型强化学习熵机制

来自多机构的研究者揭示模型强化学习中熵变化机制。发现策略熵在训练中急剧下降致性能停滞,提出 Clip - Cov 与 KL - Cov 两种正则化技术调控高协方差标记,遏制熵塌缩,在部分数据集上性能提升显著。

机器之心
新闻资讯7

Claude灾难级宕机,全球开发者集体炸锅!Anthropic三连翻车被怒喷

4月6日Claude新功能Ultraplan上线就遭遇规模宕机,开发者看到满屏‘授权失败’等。此前源码泄露,现又被指修改系统提示词报错、性能下降。虽Ultraplan有效果,但token消耗,Anthropic太急,产品稳定性堪忧。

新智元