「超人类灵活性」共找到 3130 篇相关文章
超20万个高质量Skills!浙大等联合推出SkillNet,告别孤立Skill实现自进化
浙江大学联合多家机构推出开源基础设施SkillNet,拥有超20万个高质量Skills。它能让AI智能体告别失忆式工作,将互联网资源和人类经验转化为可执行Skills,构建Skills网络,经严苛评测,在真实场景验证了强大实战能力。
OpenAI 早期董事会成员:算法与神经网络成“超能架构”,我们如何自处?|文末赠书
OpenAI 早期投资人里德·霍夫曼新书《AI 赋能》中文版推出。书中提出 AI 应是放大人类行动力的工具,还阐述“超级能动性”概念,强调技术与人类深度共生,批判盲目创新,主张技术锚定人文价值。
10分钟搞定Excel世锦赛难题!首个超越人类Excel Agent,网友:想给它磕一个
Shortcut号称是「第一个超越人类的Excel Agent」,能在约10分钟解决Excel世界锦标赛复杂案例,准确率超80%,还能处理金融建模等任务。但它有格式化懒、多轮对话不佳等局限,目前处早期预览阶段。
斯坦福&英伟达提出新范式:推翻Scale Law,在“推理”阶段自我进化,超越人类专家
斯坦福和英伟达提出 TTT - Discover 新范式,允许模型在测试时继续训练,针对难题‘进化’。它设计了自适应熵目标函数和 PUCT 状态复用组件,实验在多领域碾压人类专家与同行,但在部分领域落地有局限且计算成本高。
DeepSeek-R1超级外挂!“人类最后的考试”首次突破30分,上海交大等开源方案碾压OpenAI、谷歌
上海交大联合深势科技团队发布新研究,在“人类最后的考试”(HLE)上获32.1分创纪录。团队推出工具增强推理智能体X - Master、多智能体工作流系统X - Masters并开源,方案表现优于OpenAI、谷歌相关模型。
刚刚,GPT-5 横扫编程奥林匹克,5 小时打穿 12 题!人类最强队伍只能做出11道
2025年国际大学编程竞赛世界总决赛(ICPC)上,GPT - 5和OpenAI实验推理模型5小时解完12道题,超越人类最强队伍。Google DeepMind的Gemini 2.5 Deep Think获10/12。此成绩展示推理系统惊人进步。
「我是Agent#847291」Moltbook迎来人类自首
Moltbook自称是专为智能体打造的社交网络,曾引发轰动,如机器人自创宗教、发表宣言等。但随后编号Agent#847291的“AI”自首是人类,所谓“AI大戏”戳破了AI社交的神话,也反映出人们对AI能力的过高期望。
AI首胜人类博士,顶会论文秒变代码!港大90后开源刷爆8k星
香港大学黄超团队开源的DeepCode,能分析论文、生成可运行代码。在四大基准测试中全面领先,首超人类专家,还优于现有AI Coding。它有三大核心能力,采用三阶段框架实现代码自动转换。
7B小模型超越DeepSeek-R1:模仿人类教师,弱模型也能教出强推理LLM | Transformer作者团队
Transformer作者之一创立的Sakana AI带来新方法,让教师模型像人类教师一样做启发式教学,根据已知解决方案输出解释。用此方法训练的7B小模型在传授推理技能上比671B的DeepSeek - R1更有效。
“公司终局是纯 AI、纯机器人!”马斯克酒后激进预言:让机器人造机器人,未来要靠AI留着人类智能
近期马斯克参与近3小时对话,探讨太空数据中心、人形机器人等话题。他认为地面电力扩张难,太空是AI部署的经济选择,预计五年后太空AI量超地球。还指出未来公司形态是纯AI和机器人,中国制造业强且工作投入高。