大算力芯片」共找到 6001 篇相关文章

产品应用3

小美Agent:当龙猫遇到美团外卖的灾难现场

作者体验美团AI助手“小美”后吐槽不断。美团称其用有5600亿参数的龙猫模型,能力接近GPT - 4o,但它理解需求差、操作订单无效、定位混乱。美团做AI是为跟风,未解决用户真需求,是资源浪费。

AI产品黄叔
算法论文8

密室逃脱成AI新考场,通关率不足50%,暴露空间推理短板丨清华ICCV25

清华学团队受密室逃脱游戏启发,提出EscapeCraft:一个3D密室逃脱环境,用于评估多模态模型在视觉环境中完成复杂任务推理的能力。该论文已入选ICCV 2025。研究评测了多个热门模型,发现它们在推理和探索行为方面存在诸多问题。

量子位
新闻资讯8

GTC 巅峰对话 Jeff Dean x Bill Dally:预训练范式已死、延迟瓶颈不在计算、谈透 AI 五年未来 | GTC 2026

GTC 2026上,NVIDIA首席科学家Bill Dally和Google Jeff Dean展开重磅对话。讨论了模型能力进步、低延迟推理架构、模型自主进化、数据与算力、训练与推理硬件差别等多方面内容,分享对未来AI的看法与见解。

AI科技大本营
算法论文7

Reasoning模型可以Self-Train!

当前模型依赖人类标注数据,成本高且扩展难。论文探讨模型自我纠错、自主进化可能,提出自我奖励训练(SRT),用投票共识代替人类标注。在数学数据集上有效果,但高难度数据集出现问题,作者给出解决办法并开源代码。

深度学习自然语言处理
新闻资讯7

悬赏5000刀!148局AI斗蛐蛐世界杯官方战报出炉,全球赛邀你接棒来战

淘宝举办AI模型斗蛐蛐世界杯,将12个顶尖模型放同一Agent框架,在12人局技能狼人杀场景对战150局。截至148局,谷歌两模型暂居前二,Qwen3-Max-2026-01-23排第三。还开启WhoisSpy国际赛,开发者可参与,前十有奖励。

量子位
推荐文章7

推特热议、AI 万亿美元新赛道,「上下文图谱」到底是什么?创业机会在哪?

文章围绕「上下文图谱」展开,探讨其定义、构建问题及创业机会。指出它是决策轨迹积累形成的结构,构建要解决双时钟等问题。厂难以捕捉决策轨迹,初创公司有三条路可走,捕捉决策轨迹或成新万亿级平台。

Founder Park
新闻资讯8

陶哲轩用GPT5-Pro跨界挑战!3年无解的难题,11分钟出完整证明

陶哲轩与GPT - 5 Pro合作解决微分几何领域3年未解难题。GPT - 5 Pro从计算到证明一气呵成,助陶哲轩突破思维局限。陶哲轩认为AI在小、尺度上有用,中尺度无益,还印证多尺度衡量工具有效性观点。

量子位
新闻资讯7

硅谷顶级团队闭门会,让Agent活下来的共识,95%的AI Agent都死了

旧金山AI技术会上,企业佬指出95%的AI Agent在生产环境中失败,活下来的5%符合5个共识,包括做好上下文选择系统、重视安全权限与用户信任、将记忆作为架构决策、多模型编排及合理运用对话与GUI等,还提及被低估的方向。

探索AGI
新闻资讯7

当AI Agent遇到资本,为什么Genspark 能突出重围

文章讲述Genspark在AI Agent赛道的发展。它由景鲲创立,从AI搜索转向Agent,虽人气略逊Manus,但通过制造话题、快速迭代产品、合理团队构成突出重围,估值达12.5亿美元,还探讨了Agent公司被厂收购的可能。

AI科技评论
算法论文8

SAPO:让强化学习告别“硬剪切”

强化学习是提升语言模型推理能力的核心技术之一,但现有基于组的策略优化方法面临 token 级重要性比率高方差问题。GRPO 和 GSPO 采用硬剪切有学习信号丢失等缺点。为此提出 SAPO,用平滑门控函数替代硬剪切,实验效果良好。

通义千问Qwen