人工智能评估」共找到 1182 篇相关文章

开源动态7

解放双手!开源 AI 桌面智能体

桌面智能体Bytebot是拥有专属计算机的人工智能,有完整虚拟桌面。它能使用任意应用、处理文档等。赋予AI独立计算机可解锁新能力,项目地址为https://github.com/bytebot-ai/bytebot。

GitHubStore
新闻资讯7

国产模拟芯片迎来升维关键时刻

企业上半年财报显示,2025年模拟芯片正走出周期性低谷。国内厂商面向新兴场景,从多维度创新,向高端领域渗透,但在高端市场、产品矩阵、人才和生态方面与国际企业有差距,需把握创新方向。

芯师爷
算法论文8

比思维链准43%!逻辑脑+大模型直觉,推理可靠性大幅提升

中德研究团队发布成果,给大模型外挂「逻辑脑」,结合答案集编程与LLM,构建神经 - 符号框架,提升空间推理准确率,让AI能说清逻辑、跨任务迁移,迈向更可靠的通用推理。

新智元
推荐文章7

别再手动百度了!让 AI 帮你“开挂”搜全网,效率 x10

随着DeepSearch问世,搜索模式正从传统网络搜索向智能体搜索转变。文章拆解Search Agent核心模块,围绕制定任务、搜索、优化、应用和评估分析,介绍各模块特点、架构及优化方向等。

CourseAI
新闻资讯7

OpenAI IMO金牌团队爆料:AI拒绝作答第六题

OpenAI IMO团队接受采访,透露让模型获IMO金牌的项目仅用两三个月、核心开发者仅三人。还谈及模型证明风格、第六题失分原因、解决千禧年大奖难题距离等,强调通用技术及面临的新挑战。

机器之心
算法论文8

想清楚再动手:具身智能也要学会脑补未来和择优执行 | RSS 2025

近年来基础模型在具身智能领域能力惊人,但在真实部署中常‘用不好’。卡耐基梅隆大学与伯克利人工智能研究院团队提出 FOREWARN 框架,结合‘世界模型’与‘多模态语言推理’,解决部署智能难题。

机器之心
新闻资讯7

OpenAI 高管凌晨发飙:「有人闯进我们家偷东西了!」

Meta CEO扎克伯格从OpenAI挖走四名高级研究人员,OpenAI首席研究官Mark Chen凌晨发飙,称像有人闯进家偷东西。Meta以1亿美元签约奖金挖角,OpenAI积极应对,还反思公司方向。

AGI Hunt
产品应用8

Nature报道:谷歌新模型1秒读懂DNA变异!首次统一基因组全任务,性能碾压现有模型

谷歌DeepMind团队推出生物模型AlphaGenome,能从1兆碱基DNA序列中预测数千种功能基因组特征,评估变异效应。它统一多任务,性能超现有模型,是生物领域里程碑,将助力理解疾病。

量子位
开源动态8

Agent全自动搭建代码运行环境,实时更新解决评测过拟合/数据污染问题|微软

长期以来主流代码修复评测基准SWE - bench问题多,制约AI模型能力展现。微软发布SWE - bench - Live,引入新Issue,实现环境自动化构建与更新,打破传统局限,还揭示传统基准过拟合问题。

量子位
新闻资讯7

Palo Alto5亿美元收购的Portect AI都有什么产品和技术?

2025年4月25日,Palo Alto Networks超5亿美元收购Protect AI,为客户提供端到端人工智能安全保障。Protect AI有两个开源软件ModalScan、LLM Guard和三个平台产品Gardian、Recon、Layer,防护方案完整。

AI与安全