基准表发现」共找到 1842 篇相关文章

算法论文7

Nature重磅研究:大模型让你变得更聪明还是更笨了?创造力增强还是扼杀了?

《自然》研究明,大语言模型对创造力的影响取决于任务。简单任务中,它像灵感助推器,分担认知负荷;复杂任务里,易致‘创意固化’,长期依赖还可能使大脑‘变懒’。需按需调节使用。

AIGC开放社区
算法论文8

Anthropic重磅研究:250份文档就能 “搞垮” 大模型?

Anthropic等团队发布研究,进行大规模投毒攻击模拟。结论是投毒大模型所需‘毒药’数量与模型大小和干净数据量无关,取决于投毒文档绝对数量,250份就能‘搞垮’模型,改变了对AI安全的认知。

AIGC开放社区
算法论文8

备受Meta折磨,LeCun依旧猛发论文!新作:JEPAs不只学特征,还能精准感知数据密度

备受Meta审核规定“折磨”,LeCun仍发新论文。其团队发现自监督模型JEPAs学会了数据“密度”,打破学界以往认知。还提出JEPA - SCORE工具,经多组实验验证其效果。

量子位
算法论文8

首篇WebAgents综述:大模型赋能AI Agent,实现下一代Web自动化

互联网任务重复繁琐,香港理工大学研究人员从架构、训练和可信性等角度,总结WebAgents代性方法,梳理研究进展。WebAgents能根据用户指令完成网页任务,其发展预示人机关系新纪元。

新智元
推荐文章7

推荐!5分钟上手Chrome MCP,替代5个付费AI

作者测试发现Chrome MCP能替代大部分付费AI工具,如Cubox、音频工具等。它能让Claude控制浏览器,操作简单,1小时可配置,还能年省2000元,提升效率。

AI 产品自由
开源动态8

AI破译生命!微软蛋白质研究「超级加速器」登上Science

微软研究AI for Science团队推出BioEmu,能模拟蛋白质在平衡状态下的各种可能结构集合。它输入蛋白质序列就能生成大量结构样本,预测性质,速度比传统方法快10万倍,已开源助力药物研发。

新智元
产品应用8

刚刚,奥特曼放出ChatGPT「统一智能体」!惊呼真AGI,最卷打工人来了

奥特曼带队直播发布ChatGPT agent,它融合三大技术优势,可自主工作,还能上网直出PPT、Excel。在多项测试中刷新SOTA,2025年将成全新AI杠杆,解锁「超级个体」模式。

新智元
开源动态7

国产 AI 昇腾推理不再高门槛?开源技术栈推理性能对比解析

文章聚焦昇腾 NPU 大模型推理,对比 MindIE 和 vLLM Ascend 推理性能。因 MindIE 使用门槛高,昇腾联合 vLLM 社区推出插件。实验用 GPUStack 平台,结果显示二者在不同场景各有优势,呼吁构建国产 AI 基础设施体系。

PaperAgent
推荐文章8

直播预约 | Evaluation论文分享@ICML&ACL2025

2025年6月11日20:00将直播分享Evaluation论文。多位嘉宾参与,涉及SyncPL奖励建模、文本事实一致性验证、大模型评测方法等多领域论文,涵盖模型优化、基准测试等内容。

深度学习自然语言处理
算法论文8

中国团队让AI拥有「视觉想象力」,像人类一样脑补画面来思考

上海交通大学等团队提出 Thinking with Generated Images,让大模型像人类一样用「脑内图像」推理。该研究区分三种视觉思维模式,提出核心技术框架,解决视觉推理局限,实验效果好,未来有望在多领域突破。

机器之心