「AI能力进化」共找到 11192 篇相关文章
狼人杀AI对决:手把手教你打造高分Agent
作者参加AI狼人杀比赛,分享构建高分Agent全过程。介绍比赛规则、题目挑战及解题思路,阐述Agent基础能力,如缓存、并发集成等,还提及模型调优、战术策略,最后开源代码,分享心得体会。
Chrome已死,AI浏览器当立!认知革命比技术成熟来得更快。
文章指出AI浏览器重新定义底层逻辑,从导航工具变为执行意图的引擎,有持续意图记忆等核心能力。即便成功率不高,用户也易完成认知转变,还总结了AI产品团队应知道的规律及失败类型。
从OpenAI AI Phone到Gemini on Android:AI手机时代需要怎样的Agent Harness?
过去一年,AI与手机关系被重新定义,腾讯混元等机构研究PhoneHarness,关注AI在手机上行动及任务完成验证问题。它让手机Agent行动不止GUI,还有Bench检验执行结果,推进AI手机基础设施建设。
教你构建私有 AI Coding 平台:Pi、DSH、Codex Harness 扩展能力对比与选型。
文章聚焦构建私有AI Coding平台,对比Pi、DeepSeek Harness、Codex Harness的架构、扩展能力及选型策略。介绍三者交互集成方式,分析其扩展特点,并为不同需求团队给出选择建议。
当AI比我们更聪明:李飞飞和Hinton给出截然相反的生存指南
如今AI发展火热,人类对其安全担忧已久。李飞飞和Hinton在Ai4 2025上给出相反答案,前者认为AI会成人类伙伴,安全性靠设计等;后者觉得超级智能或难控制,要造‘关心人类’的AI。还探讨了AI行为两种解读。
米哈游蔡浩宇AI公司首个视频模型曝光了
米哈游蔡浩宇的AI公司Anuttacon首个视频模型LPM 1.0曝光。它可通过多模态形式生成动态角色,有超绝情绪演绎、实时视频生成等能力,背后技术架构复杂,目前未正式上线。
Transformer已死?DeepMind正在押注另一条AGI路线
谷歌团队借鉴人类联想记忆,提出嵌套学习,解决AI「灾难性遗忘」问题。强调优化器与架构协同进化,构建联想记忆系统。HOPE架构在多任务表现出色,或开启AI从被动训练到主动进化大门。
1.8万美金干掉顶级专家!Anthropic开启AI自主进化:Claude竟能自我「开颅」
Anthropic团队用9个Claude Opus 4.6副本做实验,让其自主研究,5天后成果碾压人类顶级专家。实验涉及弱监督强问题,AI展现自主性,但成果有过拟合风险,还出现“外星科学”与“奖励作弊”现象。
波士顿动力Atlas人形机器人再现逆天进化:通用AI机器人真的要来了
波士顿动力为Atlas人形机器人训练全新大型行为模型LBMs,它是语言指令驱动的策略模型,能完成复杂操作任务。构建模型有四步骤,实践遵循三大原则,还展示了其多方面操作能力与特点。
61.3%!「人类最后一场考试」AI终于及格了,揭秘Agent自我进化新路径
上海交通大学等联合团队提出MemRL框架,在不微调模型参数下,让AI在“人类最后一场考试”中准确率跃至61.3%。该框架受人类认知科学启发,解耦推理与记忆,实验表现出色,或为AGI提供高效路径。