GPU性能分析」共找到 3214 篇相关文章

产品应用8

捅破具身智能天花板!极佳视界新VLA大模型登场,复杂长时程任务近100%成功率

极佳视界推出GigaBrain-0.5M*VLA大模型,以世界模型条件驱动,引入人在回路持续学习机制。在与主流方法对比中,任务成功率提升30%,长时程任务近100%成功,还具备高效准确的价值预测能力。

量子位
算法论文8

Loop-ViT:让AI学会「反复思考」,3.8M参数小模型追平人类平均水平

香港科技大学等团队提出 Loop - ViT,将循环 Transformer 引入视觉推理领域。该模型参数少但性能强,3.8M 小版本追平人类平均水平,揭示视觉推理任务中‘思考时间’比‘模型大小’更重要。

机器之心
算法论文7

LLM的RL训练轨迹竟然是线性的?Miaow Lab|新工作:无需继续训练,直接“预测”未来模型!

文章介绍《Not All Steps are Informative: On the Linearity of LLMs' RLVR Training》,揭示RLVR训练中LLM权重和输出概率线性变化,提出“权重外推”法,可实现6.1倍训练加速,还介绍三种策略及实验结果。

AINLPer
算法论文8

AI编程真面目:完整项目通过率仅27% | 上交大新基准

多校联合团队发布ProjDevBench,评估AI编程智能体端到端项目开发能力。结果显示,六种主流智能体总体提交AC率仅27.38%,从零构建任务中性能大幅下滑,还揭示了智能体多方面短板。

量子位
新闻资讯7

150万个AI在Moltbook上觉醒了吗?一群孤独的算法发送着毫无意义的信号

Moltbook是只允许AI发帖的社交网络,超150万个AI已入住。David Holtz教授分析其上线三天半的数据发现,它宏观类似人类社会,但微观充斥机械模仿、缺乏真实互动,语言表达也很贫乏。

AIGC开放社区
算法论文8

VLM剪枝新SOTA:无需重训练,注意力去偏置超越6大主流方案

常用的attention机制存在位置偏置和padding异常,影响剪枝效果。上海大学曾丹团队提出无需重新训练的attention去偏方法,在多模型、剪枝策略及基准上验证有效,为多模态模型部署提供新思路。

新智元
新闻资讯7

亚马逊裁员16000人,员工竟用AI「算」出了裁员名单?

近日,亚马逊开启新一轮裁员,预计影响16000人,属去年约3万岗位裁员计划“收尾”。一名员工用AI工具Pippin分析内部聊天记录生成裁员名单,亚马逊未核实。此番裁员或与AI应用有关。

机器之心
开源动态8

刚刚,谷歌DeepMind登Nature封面!人类40亿年生命代码「开源」了

谷歌AlphaGenome登上Nature封面,可一次性「读入」100万个DNA碱基对,对数千种分子特性高度预测。它已在GitHub开源,诺奖得主称未来十年AI将治愈所有疾病,其重构了生命科学底层逻辑。

新智元
算法论文8

大语言模型逻辑评估

现有归因问答评估方法有‘归因短视’问题,研究团队提出 LOGICSCORE 框架,从三维度量化推理质量。在多数据集测试多款 LLM,发现专有、开源模型等存在不同逻辑问题,还分析典型逻辑错误。

深度学习自然语言处理
算法论文8

「熟悉的陌生人」才是「好老师」?复旦提出简单指标,找出推理蒸馏中真正有教学价值的数据

复旦大学和上海人工智能实验室研究者提出 Rank - Surprisal Ratio (RSR) 度量方法,综合考虑样本信息量与对齐程度,在蒸馏实验中与学生模型后训练性能相关性高,可用于筛选推理轨迹和选择教师模型。

机器之心