「AI-Agent」共找到 10643 篇相关文章
多智能体大语言模型中的人类自适应协作
尽管大语言模型有进展,但纯自治多智能体系统有局限。为此提出 HILA 框架及双环策略优化机制,结合 DLPO 的 HILA 在基准测试中表现出色,为构建 Agentic 系统提供指导。
来自MiniMax M2.5的震撼 :小尺寸几乎打平opus4.6,巨便宜,巨能干活,速度巨快
MiniMax M2.5正式发布,是优秀国产模型。它专注极致优化,部署方便、价格实惠、性能顶尖。在多项基准测试表现出色,速度提升、成本降低,多维度实现突破,已在MiniMax Agent全面部署。
大模型幻觉的源头找到了!清华团队锁定大模型宁愿说谎也要讨好人类的神经元
清华大学研究团队深度解剖大语言模型微观机制,确认幻觉关联神经元存在,揭示其与过度服从行为相关。通过干预神经元激活状态可增减模型幻觉行为,为开发可靠 AI 系统提供靶点。
深度之赌:从卧室到上帝机器
文章讲述现代AI秘史,从Jeff Dean本科研究神经网络失误,到Google Brain诞生;还有Hinton等深度学习先驱经历,如Hinton当实习生、AlexNet诞生等,也提及Google发展及未先发ChatGPT原因。
用企业级智能体落地,还有谁没踩这四种大坑?无问芯穹的系统性解法来了
企业级智能体落地遇效果、稳定、成本和商业闭环四大难题,无问芯穹推出智能体服务平台,从多方面提供解决方案,并展示SysCoding Agent案例,其基础设施或成企业拉开差距关键。
用户集体大逃亡!Cursor“自杀式政策”致口碑崩塌:“补贴”换来的王座,正被反噬撕碎
很多开发者吐槽和弃用 Cursor,其付费后砍功能、技术变差、营销成“障眼法”,引发信任危机。部分用户转向 Claude Code,AI 编程工具竞争焦点升级,未来有向智能体演进等趋势。
Claude Code发布4个月,用户已经11.5万了,开发者:200 美元/月不算贵
Anthropic的Claude Code发布4个月吸引11.5万开发者,一周处理1.95亿行代码。它集成Claude Opus 4模型,功能实用,口碑好,让开发者觉得物有所值,反映开发者对AI编程工具接受度提升。
798现场|算法下的生活新常态
科技发展重塑社会关系,艺术为理解变化提供视角。798艺术区有两个展览,郭城的“虫”探讨技术理性双重性,蒲英玮的“红色计算机”探讨AI权力结构,展现科技与文明发展寓言。
刚刚,DeepSeek V4 Pro正式版发布,多项对标Fable 5
刚刚,DeepSeek V4 Pro正式版发布,多项对标Fable 5,Agent能力几乎全方位碾压Opus 4.8,无限逼近Fable 5。API平台已更新,价格和之前Pro预览版基本一致,但网友实测发现CoT表现不佳。
5.2万Star项目被迫出走GitHub,但开源世界只剩更差的选择
Ghostty 项目创始人 Mitchell Hashimoto 宣布项目将逃离 GitHub,因其频繁故障影响工作。开发者群体对 GitHub 现状失望,认为平台重心转向 AI 产品致基础设施变差。但 GitHub 外的开源替代方案都有明显缺陷。