技术方案评测」共找到 3957 篇相关文章

开源动态8

红杉中国推出 Agent 基准测试「xbench」,双轨评估体系,关注 AI 真实场景的效用

红杉中国开放AI和Agent基准测试工具「xbench」,采用双轨评估体系,构建多维度测评数据集。首期发布两个核心评估集并排名,提出垂类Agent评测方法论。该工具旨在解决现有评估问题,关注AI真实场景效用。

Founder Park
新闻资讯7

北京AIGC视听产业创新中心:“数字浮游”今日开展,AI视听实验室赋能艺术实践

2026年3月7日至5月5日,“数字浮游——第六届北京电影学院国际新媒体艺术三年展巡回展”在郎园Station X美术馆举办。该展由北京电影学院与X美术馆联合主办,汇集24位(组)艺术家的26件作品,呈现数字技术下的创作环境。

郎园Station
新闻资讯7

国内首个硅谷科创展团将入驻AWE2026东方枢纽展区

国内首个硅谷科创展团将入驻AWE2026东方枢纽展区,由硅谷科技评论发起,集结15家企业,近60位高端买家也将参展。展团覆盖多前沿赛道,展示创新技术与产品,展区实行专业观众提前24小时预约制。

新智元
产品应用8

让欧美老外彻底“真香”,这家中国割草机器人品牌正在定义一个行业新标准

在CES 2026上,未岚大陆发布割草机器人五大新品,呈现“Navimow标准”体系。其新品实现免部署自动建图,用EFLS™ LiDAR⁺三重融合定位系统应对复杂环境,以Xero - Turn™方案解决伤草问题,定义行业新标准。

量子位
新闻资讯8

英伟达:RLP 让 AI 在预训练时就学会思考

英伟达研究团队发布 RLP 技术,与传统大语言模型训练不同,它在预训练阶段就让模型学会'先想后说'。通过奖励机制自我监督,实验效果惊人,性能提升显著,不挑数据,打破了大模型训练范式。

AI工程化
算法论文8

UserBench 与 UserRL 带来的交互智能范式转向

当下大模型在与用户交互时存在不足,来自UIUC与Salesforce的UserBench和UserRL两篇新作,将‘用户价值’量化,把‘可测的交互’转化为‘可训练的策略’,从评测和训练层面推动模型向‘懂用户’转变。

深度学习自然语言处理
新闻资讯8

一年4次迭代,狂堆GPU成真!微软AI冷液灌芯,散热暴涨3倍

AI芯片发热问题严重,限制了其发展。微软推出微流体冷却技术,在芯片内开液体血管,散热效率最高提升3倍,温升降65%。一年4次迭代解决诸多难题,影响从省钱到使用体验,更是抢跑未来的布局。

新智元
开源动态7

腾讯Youtu-agent 不会代码,也能搞定数据分析+深度研究+HTML报告

腾讯开源的Agent框架Youtu - agent灵活高性能,可用于数据分析等多任务。基于openai - agents构建,适配多种模型API等。突出优势是能自动化生成智能体及其配置,采用YAML配置方案,有内置‘元智能体’,还完全异步。

CourseAI
新闻资讯7

AI侵权愈演愈烈!全国首部“AI生成内容合规”标准欢迎参与起草

近期AI侵权频发,暴露AIGC技术下沉应用危害。中国电子商会等联合起草全国首个AI生成内容合规团体标准《人工智能生成内容合规管理指南》,规范合规要求,还给出四大核心路径解决企业痛点,并阐述标准价值,现公开征集起草方。

AI寒武纪
开源动态7

一夜之间,Claude Code删掉了80%系统提示词

本周五,Anthropic 技术团队成员 Thariq Shihipar 介绍新一代大语言模型工程趋势变化。Anthropic 发现旧提示词工程范式在新一代强推理模型发布后或过时,新的 Claude.md 应精简,大砍系统提示词后可把特定任务上下文交给 Skill。

机器之心