成果评估」共找到 1411 篇相关文章

产品应用7

比 Context7 更靠谱:Exa-code 靠 1B+ GitHub 与 Stack Overflow 减少幻觉

Exa团队索引超1B+文档、GitHub仓库等内容,exa - code对其混合搜索、分块处理。它是首个为编码代理制作的Web规模上下文工具,在代码幻觉评估中表现超流行网页搜索工具,核心技术有专为AI的搜索引擎和高效返回上下文。

AI进修生
推荐文章7

Palantir 创始工程师深度分享:FDE 模式是 Agent 时代的 PMF 范式

本文编译前 Palantir 高管 Bob McGrew 对 FDE 模式的思考。FDE 团队填补产品与客户需求差距,交付有价值成果。在 AI Agent 时代,因产品需大量探索且要从企业内实践出发,FDE 或成创业公司新范式。

海外独角兽
算法论文8

清华大学x生数科技:从波形到隐空间,AudioLBM引领音频超分新范式

音频超分辨率是提升音频体验的关键技术,但高频细节损失是挑战。OpenAI的Sora 2树立高保真音频生成标杆,现有学术模型有局限。清华与生数科技团队发表两项成果,AudioLBM展现通用高分辨率音频生成潜力。

量子位
新闻资讯7

LeCun不想再忍了!亲口承认要辞职

图灵奖得主LeCun或辞去FAIR首席科学家职务,原因是对Meta近几个月AI部门组织调整不满,FAIR成果发表需额外审核,且Meta战略调整频繁、让他被降职。Meta内部不满情绪叠加,新老员工矛盾凸显。

量子位
算法论文7

机器人从炫技 Demo 走向上岗,两篇 ICML 顶会论文拆解背后的智能底座

在WRC世界机器人大会上,云蝶科技发布RoboForge系统级具身大脑和WING任务型本体。其科研团队两项成果POLIA与Strat-Reasoner发表于ICML 2026,从视觉证据和他者意图两方面,为理解具身大脑技术提供切口。

AI科技评论
新闻资讯7

谷歌约战,DeepSeek、Kimi都要上,首届大模型对抗赛明天开战

太平洋时间8月5 - 7日,8款前沿AI模型将在Kaggle Game Arena展开为期3天的国际象棋比赛,参赛方都是AI界顶流。谷歌称现有基准测试难跟上模型发展,这场比赛是探索新评估方法。赛制为单败淘汰制。

机器之心
新闻资讯8

黄仁勋台上最强GPU炸场,台下感叹“中国芯片爆发”,瞄准6G投资诺基亚

英伟达发布会上,黄仁勋官宣新GPU Vera Rubin,还谈及中国芯片爆发,夸中国模型成果显著。此外,英伟达公布量子计算、6G通信等领域布局,与诺基亚合作入局6G并投资,不过各领域均面临竞争。

量子位
产品应用7

18年前不让你苦修PS的美图,这次不让你苦修AI了

当前AI创作门槛渐高,美图在影像节推出8款AI产品,让用户少学技能拿结果。产品围绕交付成果,定位不同但本质相同。美图还在商业模式、组织架构上转变,市场成绩亮眼。

量子位
算法论文8

从繁杂技巧到极简方案:ROLL团队带来RL4LLM新实践

当前RL4LLM领域发展快但存在标准、结论不一及机制解释不足等问题。阿里巴巴淘天集团和爱橙科技联合高校基于ROLL框架研究,评估关键技术组件,提出简化算法Lite PPO,在多基准上表现佳。

机器之心
新闻资讯7

年仅24岁、博士退学、项目平平,却签下2.5亿美元天价Offer?Meta的这波操作,全网看懵了

在AI军备竞赛中,Meta为24岁AI研究员Matt Deitke开出2.5亿美元薪酬包。他博士退学、创业不久,项目虽在热门赛道,但也有人质疑其成果与报价不匹配,这反映AI人才争夺激烈。

AI前线