善意的混乱」共找到 10457 篇相关文章

算法论文8

大模型赋能具身智能:自主决策和具身学习技术最新综述

具身智能是通往通用人工智能关键路径,但传统方法有泛化瓶颈。电子科大最新综述梳理大模型赋能具身智能自主决策与具身学习,还将‘World Model’纳入统一框架,为研究者提供路线图。

PaperAgent
推荐文章7

为什么95%智能体都部署失败了?这个圆桌讨论出了一些常见陷阱

硅谷圆桌论坛指出,95%AI智能体部署失败,原因并非模型不智能,而是基础框架、上下文工程等未成熟。还探讨了上下文工程实践、信任治理、记忆设计、多模型编排等问题,给出创业者需思考问题。

机器之心
新闻资讯7

危险?OpenAI 模型行为负责人:人类很快会进入「AI意识」,当前最重要是控制人机关系影响

OpenAI模型行为与政策负责人Joanne Jang发文指出,与其争论AI是否有意识,不如关注其对人类“情感福祉”影响。文章探讨了OpenAI在人机关系上处理,以及如何塑造模型行为,还提及未来计划。

AI寒武纪
新闻资讯7

GPT-5魔幻现实主义:当技术神话撞上用户预期

奥特曼宣传数月GPT - 5上线24小时遭用户吐槽,实测基础数学、拼写有问题。其采用智能路由系统,调教欠佳。奥特曼承认自动切换器故障,基准测试结果混乱,还暴露AI评价难等问题。

AI工程化
推荐文章8

为什么今天造大模型人,一半在学物理

文章指出在AI前沿,不少定义方向人出身物理。物理训练赋予品味与做AI方法论高度重合,体现在统计力学与神经网络、对普适规律信仰等方面,还提到Scaling Laws最能体现这种品味。

五源资本 5Y Capital
开源动态7

Karpathy刚开源autoresearch,我拿来优化龙虾skill,成功率从56%飙到92%

Karpathy发布开源项目autoresearch,可让AI优化AI。作者分享用其优化skill实践,介绍优化流程,指出可将模糊表述拆成可判断是非题,还提及定义评估标准方法与常见错误修正。此外,还能用于代码性能优化。

探索AGI
开源动态8

白嫖微软开源Web Agent,独立开发者第二双手:自动刷网页、跑脚本、盯进度,全交给 Magentic-UI

Magentic-UI是微软开源Web Agent界面,能控制浏览器、执行代码等,解决长流程、重复且让人不放心全交给AI任务。它可视化操作,有可复用计划图库等亮点,使用体验好,适合特定开发者。

小华同学ai
开源动态8

AI给你总是平庸答案?5.8万星插件证明:问题不在模型,在你

GitHub上5.8万星`taste-skill`仓库,无模型代码,仅用文本规则让AI编程工具输出更有品味。揭示AI默认给平庸答案是概率采样结果,还给出反中位数三问及AI时代变贵是判断力。

AI Reading Hub
产品应用7

谷歌发布 Gemma Scope 2,深化对 LLM 行为理解

Gemma Scope 2 是谷歌推出解释 Gemini 3 模型行为工具,结合稀疏自编码器和转码器,能让研究人员检查模型内部表示。它从多方面扩展了原先 Gemma Scope,还引入针对聊天机器人分析工具,已发布权重。

InfoQ
开源动态7

深度拆解:如何在 LangChain DeepAgents 中复现 Claude Skills 机制 ?

本文探讨在LangChainDeepAgents框架复现ClaudeSkills机制。先回顾Skills,它是Anthropic提出Agent能力注入方式,有渐进式加载特点。接着介绍让通用框架支持Skills环节,最后测试验证其效果和收益。

AI大模型应用实践