「经济规则」共找到 413 篇相关文章
装完Hermes Agent玩了一圈,我觉得龙虾已死!
Hermes Agent势头正猛,被视为龙虾以来首个真正的竞争对手。它让Agent自己做Harness Engineering,自己写、用、改Skill,还能自我迭代。文章介绍了安装使用方法,对比了与其他项目的差异。
Anthropic 重新定义智能体终局: Bash Is All Agent Need!
Anthropic工程师Thariq Shihipar提出,最强大的Agent工具是Bash和文件系统,基于Unix思想构建Agent会超传统API工具。还介绍了上下文工程、Agent Loop本质等内容,认为这或是Agent终极形态。
小模型才是 Agent 的未来?这篇立场文把话挑明了
AI Agent浪潮来袭,主流用LLM构建,但英伟达和佐治亚理工学院研究人员论文指出,多数Agent场景中,小语言模型(SLM)已足够强、更好管、更省钱,还给出迁移清单、避坑建议和参考系统形态。
AI在「赚钱锦标赛」夺冠,比人类还会做生意!躺赚时代要来了?
研究人员提出自动售货机运营模拟环境Vending - Bench,测试大模型智能体管理业务能力。实验显示不同大模型性能方差大,Claude 3.5 Sonnet净资产表现最佳,人类基线在可靠性上表现较好,各模型长周期表现波动大。
奥特曼最新访谈暗示:OpenAI终极目标是打造订阅制AI服务
奥特曼在红杉活动透露,OpenAI希望开发AI操作系统,成核心AI订阅服务,此为“柏拉图式理想”。他构想ChatGPT变深度个性化服务,还谈及语音交互、代理与编码价值及2025AI前景。
AI 开发工具的隐形战场:新一轮 IDE 之争打响!
在AI开发工具领域,VSCode成主战场,但背后有技术和策略拉扯。开发者面临战略选择,VSCode有诸多限制,OpenVSX虽提供替代方案但插件不全,Cursor崛起引发微软动作,未来走向待察。
清华艺博新展|具身之路:机器如何成为“人”
清华艺博将举办“具身之路:机器如何成为‘人’”展览,时间为2026年4月30日 - 5月6日。展览以“启思—看透—看懂—共创”为动线,呈现人形机器人发展历程,探讨智能与身体关系及人机共在问题。
不增加人手,项目效率飙升45%,OpenAI公开了一套AI实战经验
OpenAI公开基于大语言模型和专属Skill包的开源仓库维护方法论,将重复工作自动化,使项目代码合并吞吐量飙升45%。该方法由AGENTS.md、Skill包和GitHub Actions构成,还涉及任务分配、验证策略等。
评审用不用AI,作者说了算?ICML 2026全新评审政策出炉
ICML 2026 引入评审类型选择机制,作者可决定评审是否用大语言模型。政策 A 禁止,政策 B 允许但有限制。不过大模型使用规定执行难,此规则更像约定。
诺奖、金牌与SOTA:谷歌2025八大领域核心突破年终回顾
2025年是AI成为社会基础能源的关键转折点,谷歌通过全栈自研与生态标准双轮驱动构建智能基础设施帝国。从模型推理到科学发现领域均有突破,如Gemini 3系列、Ironwood芯片等,还在各领域有诸多应用与探索。