「AI推理能力」共找到 12096 篇相关文章
大模型公司挖墙脚哪家强?报告:Anthropic人才吸引力是OpenAI的8倍,留存率达80%
风险投资公司SignalFire报告显示,大模型公司人才争夺激烈,Anthropic是大赢家,顶尖AI人才留存率达80%,从OpenAI等公司挖人成效显著,秘诀在于精准挖角、独特文化和产品共鸣。
“煽风点火”让大模型“卷”起来的提升性能的套路
网友Greg Isenberg分享让AI提升性能的方法,通过利用不同AI模型如ChatGPT、Claude、Grok间的“竞争”,人为制造竞争环境,激发其潜力,可提升输出效果,且方法获很多网友验证认可。
给龙虾🦞装上一双手,直接解放了我的双手!
OpenClaw让AI Agent爆火,Violoop应运而生。它是桌边触屏AI原生硬件,实现感知 - 判断 - 执行闭环,有诸多亮点,适合特定人群,4月Kickstarter众筹发布,链路设计思路清晰值得关注。
刚刚,Anthropic联合创始人在梵蒂冈讲了什么?
教皇发布人工智能通谕,Anthropic联合创始人Chris Olah受邀发言。他指出实验室激励与正确行事有冲突,描述了AI模型特点,还提出教会应发声的三个问题,引发社区不同反应。
龙虾也能养龙虾!UCSD发布AIBuildAI智能体,MLE-Bench榜单第一
加州大学圣地亚哥分校团队推出AIBuildAI智能体,用户用自然语言描述任务,它就能自动完成AI模型开发。在OpenAI MLE - Bench测试中,其以63.1%获奖率居首,性能媲美人类专家。
英伟达确认恢复 H20 在中国销售,并推出面向中国的全新 GPU
7月15日英伟达官网发文,将恢复H20在中国销售,黄仁勋称正提交重售申请,美政府保证发许可证。还推出面向中国的全新GPU,强调AI成基础资源,致力支持开源研究等。
MiniMax M3 实测:第一流的模型,已经对执行层动手了
文章对 MiniMax M3 模型进行多维度实测。它强化 Coding 与 Agent 能力,能完成长任务,与 Sonnet 4.6 竞技各有优势,多模态能力强,价格有竞争力,MiniMax Code 意在争夺开发者工作流入口。
阿里云海外重磅发布 Qwen Cloud
5月26日,阿里云在新加坡面向全球发布Qwen Cloud。它为AI Agent而生,有Skills、CLI、Website三入口架构,一站式接入模型,覆盖六大模态,成本可控,开放多元生态,还启动黑客松活动。
让思考更准更长!强化学习新算法FIPO来了
阿里通义实验室Qwen Pilot团队发布系列博客剖析大模型强化学习机制与局限,推出新算法FIPO。该算法引入Future - KL机制,解决‘推理长度停滞’问题,在多项测试表现优异,还介绍招聘信息。
同样的模型,Claude Code凭什么比Codex强
文章探讨决定 Coding Agent 能力的 6 大核心组件。指出如今旗舰模型‘裸机’能力相近,真正拉开体验差距的是 Harness 工程质量,还开源 Mini Coding Agent 实现六大组件。