「AI能力提升」共找到 12332 篇相关文章

算法论文8

GAIR Paper 107|高校联合腾讯发布 GameCraft-Bench:AI已能端到端开发游戏,Claude Opus 四成达到可玩水平

香港中文大学(深圳)等高校联合腾讯发布 GameCraft-Bench,旨在构建基于真实游戏引擎、产物完整可运行且能验证的 AI 游戏生成评测基准,解决现有基准难衡量端到端可玩性的问题,测试显示前沿模型在游戏生成上仍薄弱。

AI科技评论
新闻资讯8

发春节红包的大厂被约谈;百度O计划曝光,文心助手MAU增4倍;影石CEO回应年会送出5套房|AI周报

本周AI行业热点不断,大厂春节红包促销被约谈,百度文心助手MAU猛增4倍,影石年会豪送5套房。还有模型更新引吐槽、谷歌发债、迪士尼侵权指控等事件,也有新模型发布及企业应用新进展。

AI前线
开源动态8

自然语言秒搜千级节点!阿里ComfyUI-Copilot开源:AIGC实时工作流一键生成!

在AIGC领域,ComfyUI虽强大但节点复杂。阿里团队开源ComfyUI - Copilot,通过自然语言交互增强工作流自动化,有节点搜索、工作流构建等功能,简化操作,提升效率。

开源星探
新闻资讯7

OpenAI 收购 A/B 测试新秀Statsig :印度裔创始人出任应用CTO,执掌 ChatGPT 产品工程

OpenAI宣布收购A/B测试巨头Statsig,其创始人Vijaye Raji将任应用部门CTO,负责ChatGPT等产品工程。Statsig为企业提供A/B测试等服务,收购将增强OpenAI实验能力。

AI寒武纪
推荐文章7

大厂的AI不限量补贴终会结束!Hermes Agent作者:开源框架真正的狠招是把Claude对Anthropic的忠诚抢过来

科技创作者 Peter Yang 对话 Hermes Agent 作者之一 Karan Malhotra,探讨 Hermes Agent 与其他产品的差异、模型谄媚问题、开源意义等。Karan 指出其独特自我改进系统与专注用户需求特点,还提及让模型更贴合用户的方法。

AI科技大本营
产品应用8

马斯克挖不动的清华学霸,一年造出 “反内卷 AI”!0.027B 参数硬刚思维链模型,推理完爆 o3-mini-high

新加坡 Sapient Intelligence 推出小型模型 HRM,参数仅 2700 万却能解决复杂推理难题,其不依赖“思维链”,借鉴人类大脑工作方式。该模型准确率超先进思维链模型,推理能力强,具经济性,可提升任务效率。

InfoQ
新闻资讯7

Artificial Analysis:DeepSeek成为世界前二AGI实验室

模型与API独立分析公司Artificial Analysis对DeepSeek R1-0528评估显示,其一举超越xAI、Meta等,与谷歌并列全球第二大人工智能实验室,在多方面性能提升,缩小了开源与闭源模型差距。

AI寒武纪
产品应用9

Claude Opus 5.5 到底强在哪?大幅降价后谁会受影响?

本文从工程视角拆解Anthropic新品Claude Opus 5.5,分析其能力升级、定价调整,分享开发者实测案例,解读此次升级对AI行业格局的影响。

AI Reading Hub
算法论文8

年度AI论文!全球三大顶尖模型的防蒸馏机制全面告破:小模型“套出”大模型隐藏思维链,Kimi-K3重现概率异常

这篇论文指出三大前沿AI模型厂商API有密码学旁路漏洞,攻击者用轻量级模型就能恢复大模型隐藏思维链数据。还揭示部分模型训练或借鉴大模型思维链,此漏洞也致企业数据隐私安全问题。

AI前线
产品应用7

自动化评测的九九归一——评测agent

本文提出统一评测Agent架构,实现评测全链路自动化。它能学习标注标准,完成自动标注等工作。还介绍架构、解耦方法、模型优化及训练方案,解决多模态幻觉等问题,提升机审率,节省标注成本。

阿里云开发者