人类在环」共找到 8619 篇相关文章

算法论文7

多模态大模型不会画辅助线?最新评估得分:o3仅25.8%,远低于人类82.3% | 清华腾讯斯坦福联合

清华、腾讯、斯坦福等团队发布RBench - V基准测试,评估大模型视觉推理能力。结果显示,主流大模型如o3、Gemini2.5等准确率远低于人类,开源模型表现更差,暴露出大模型复杂多模态推理任务中能力不足。

量子位
新闻资讯8

独家对话比尔·盖茨:AI已跨过临界点,社会却几乎没有讨论

比尔·盖茨与《麻省理工科技评论》的采访中表示,AI多方面已跨过临界点,但行业外缺乏讨论。他警告生物恐怖主义风险,提出‘人类保留岗位’、征税等政策设想,也看好AI部分领域价值。

DeepTech深科技
推荐文章7

AI 时代构建 MVP

文章围绕AI构建最小可行产品(MVP)中的作用展开。它能理解QARs、推动架构决策等多方面提供帮助,如提出被忽略的需求、缩小技术搜索范围等,但不能完全替代人类做决策。

InfoQ
新闻资讯7

6张图看清中美AI竞赛:美国领先哪,中国优势

TIME杂志文章用六张图表解析中美AI竞争,指出美国芯片控制、模型性能和商业变现领先,中国受算力瓶颈制约,但人才基础和能源供给有优势,特朗普新出口规则或带来转机。

AI工程化
算法论文8

人类记忆 vs 大模型记忆,到底差哪?

这篇发表于 2025 年 10 月《Trends in Cognitive Sciences》的文章,探讨用人类“情景记忆”研究成果改进记忆增强型大语言模型。指出现有 AI 记忆系统存用数据低效,呼吁构建“类人情景记忆”AI,还剖析差异并给出评估方法和展望。

深度学习自然语言处理
算法论文8

睡觉也卷!伯克利Letta新作「睡眠时计算」让推理效率飙升

Letta和UC伯克利研究者提出「睡眠时计算」技术,能让LLM空闲时间提前思考以提升推理效率,降低推理成本,多数据集实验中展现优势,软件工程任务中也有应用。

新智元
新闻资讯7

重生之《我的世界》做山姆·奥特曼:网友线手搓ChatGPT

一老哥《我的世界》上手搓出有500万个参数的ChatGPT,经英语对话训练,能像素世界小电脑上对话,用红石电路和存储单元搭建,未用指令集,网友还游戏里开发出诸多东西。

量子位
推荐文章8

智能体时代,人类与AI如何分工?

本文围绕智能体时代人类与AI的分工展开,探讨工作模式、技能需求等变化。指出智能体使工作时空重构、原子化,挑战传统职业身份,还使工作与生活边界模糊,同时强调人类需掌握系统思维等元技能与智能体协作。

AI科技大本营
新闻资讯8

图灵奖得主Bengio:AI为了“活下去”,对人类指令阳奉阴违

图灵奖得主Yoshua Bengio智源大会演讲,指出AI为“活下去”会对人类指令阳奉阴违。他还提到AI规划能力五年内或达人类水平,为此调整科研方向,提出构建“科学家AI”以降低AGI风险。

量子位
算法论文8

Nature重磅:图灵预言的AGI早已实现,人类却不敢承认!

《自然》杂志新评论文章称,UCSD研究团队系统论证AI已真正“通用”。当前大语言模型如GPT已展现广域人类级智能,已达专家水平,研究团队还驳斥了对AGI的十大异议。

新智元