「新版图灵测试」共找到 4902 篇相关文章
投资人不再只看大模型?AI资本新逻辑揭秘|甲子引力X
2025年AI投资进入新阶段,大模型竞赛趋理性,AI Agent等赛道加速发展,投资逻辑重构。甲子引力X圆桌对话中,六位投资人分享投资逻辑调整、新投企业及看法,探讨具身智能、物理AI落地等问题。
坚决抵制!CCF亮最狠一招,AI顶会NeurIPS新规或自掘坟墓
AI顶会NeurIPS 2026手册新增条款,限制部分国内机构研究人员评审、投稿。中国计算机学会CCF发起反制,倡议科研人员拒绝为其服务和投稿,若不改正将移出推荐目录,或重创该会议。
黄仁勋CMU演讲:取代你的是会AI的人,所有人同一起跑线,奔跑吧
卡内基梅隆大学毕业典礼上,黄仁勋发表演讲。他指出AI不太可能取代人,但善用AI的人可能取代他人。他还提及计算范式转变,新工业带来新潜能,呼吁毕业生全力奔跑塑造未来。
别用语言描述,直接点!Lovart 正式版把 AI 交互卷到新变态级别
作者分享 Lovart 正式版体验。其设计 Agent 成完全体,新增评论系统 ChatCanvas,可直接在无限画布上给 Agent 提修改要求,还吸收 Cursor 代码补全交互。支持单张和多张图片调整,奠定 AX 交互基石。
传统RAG只会翻书不会用?RAG+让Reasoning能力上一个新高度!
现有检索增强生成(RAG)技术在需复杂推理领域表现不佳,像只给菜谱不给实操演示。RAG+开创性新增“应用案例库”,与知识库构成双料库,在数学、法律、医疗场景测试中全面碾压传统方案,团队还透露了未来方向。
领先于Transformer!新架构首个1200万上下文模型SubQ,成本仅Opus的5%
Subquadratic公司提出SubQ模型,核心是SSA亚二次稀疏注意力机制。该机制改变注意力计算分配,让模型真正读长文档。SubQ是首个有1200万token上下文窗口的前沿模型,成本低、速度快,有望革新大模型扩展路径。
鹏城实验室 X 中大hcp实验室推出 RADAR : 具身智能评测的新标杆
RADAR是鹏城实验室与中大hcp实验室为具身智能领域设计的评测基准,解决现有评测体系三大缺陷,通过创新设计揭示模型不足,为研究者提供方向,推动具身智能实用化。
GUI 精准定位新 SoTA:LASER 让模型从“看全图”走向“锁重点”
多模态大模型在高分辨率、元素密集的 GUI 场景易误判。苏州大学 OpenNLG 团队提出 LASER 方法,让模型学会主动推理,通过关键区域聚焦等提升定位精度,在基准测试中表现出色。
刚刚,GPT-6正式发布!OpenAI:欢迎来到AGI时代
OpenAI正式发布GPT - 6 Astra和GPT - 6 Astra Pro,宣布AGI时代开幕。该模型训练规模大,能力升级显著,价格公布。基准测试成绩优异,在多方面表现突出,还展示诸多实际应用案例,已有企业开始测试。
御三家格局松动:Google和Meta同日发布新模型,第三名不再稳了?
2026年9月2日,Google推出Gemini 3.8 Flash,Meta发布Muse Spark 1.3。此前Google经历人事调整、旗舰延期,靠Flash维持节奏;Meta则重建团队、收窄战略。二者产品定位相似,各有优劣。