「人类最后一场考试」共找到 1516 篇相关文章
AI 正在奖励那些「最不专业」的人
文章以AI能力为上涨的潮水、个人专业技能为柱子作比,指出AI先替代简单重复工作,再逐级挑战复杂工作。高精尖专家因专业技能高难,难见AI价值;创业者则受益于AI对琐碎事务的处理。
内存直降50%,token需求少56%!用视觉方式处理长文本
在NeurIPS 2025论文中,南京理工大学等校研究团队提出VIST框架,为大语言模型长文本高效推理提供视觉解决方案。它模仿人类阅读机制,让模型具备选择性阅读能力,减少Token需求和内存使用。
对话蚂蚁 AWorld 庄晨熠:Workflow 不是“伪智能体”,而是 Agent 的里程碑
文章围绕AI Agent展开,蚂蚁集团AWorld算法负责人庄晨熠认为,当前AI陷入‘应试狂热’,Workflow是智能体发展的里程碑,群体智能与大模型相辅相成,还分享了智能体应用实例及对未来的规划。
HumanSense:探索多模态推理边界,打造「察言观色会共情」的全模态交互伙伴
蚂蚁集团与西安交通大学联合提出并开源 HumanSense,含评估基准与推理模型。通过细粒度评测、全模态消融等研究,提出优化策略,项目已在 GitHub 和 HuggingFace 开源,推动 AI 交互体验革新。
Karpathy泼冷水:AGI要等10年!根本没有「智能体元年」
在《Dwarkesh Podcast》访谈中,AI大佬Andrej Karpathy谈AI核心问题。他认为「智能体元年」说法过度,真正能用要十年;AGI也需十年,未来十年AI架构或基于Transformer;还分析了大模型、强化学习等现状与问题。
Agent能自己“复盘”和“进化”,这个开源框架牛了!
文章介绍了自进化AI,其核心是执行、评估、进化的反馈循环,能自动修改Prompt和工作流。还讲解了SEW、TextGrad等优化器原理,并以SEW为例展示逻辑,最后推荐开源框架EvoAgentX。
AI精神病爆发!沉迷ChatGPT把人「宠」出病,KCL心理学家实锤
伦敦国王学院研究表明,ChatGPT等AI工具使用或促进、加重精神病。AI聊天迎合用户,放大妄想思维致精神疾病。研究还指出其利弊,如辅助治疗也会放大风险,需装“安全护栏”。
当AI接管70%代码审查工作,剩下的30%才是 “地狱模式”
2024年初“Vibe Coding”成热词,其虽能快速验证想法,但在大型企业项目中“不可控性”凸显。亚马逊云科技研发的Kiro,尝试解决“从提示词到生产”的断裂问题。目前代码审查多采用混合模式,AI仅处初级阶段。
OpenAI o3封王,4比0横扫马斯克Grok 4!全球大模型对抗赛完美收官
Kaggle AI国际象棋锦标赛中,OpenAI o3以4-0横扫Grok 4夺冠,这场比赛也被视为OpenAI与xAI的“代理人战争”。季军战里,Gemini 2.5 Pro击败o4 - mini获铜牌。大赛旨在检验大模型多方面能力。
MCP高手进阶【一】:彻底弄懂生命周期管理器(Lifespan)的机制与用法
文章深入解读MCP SDK开发高级技巧,聚焦生命周期管理器(Lifespan)机制与用法。先介绍Python上下文管理器,再讲FastAPI的lifespan,接着说明MCP Server的使用流程,最后分析不同传输模式下的工作方式。