「多智能体AI」共找到 12607 篇相关文章
Karpathy刚开源的autoresearch,我拿来优化龙虾skill,成功率从56%飙到92%
Karpathy发布开源项目autoresearch,可让AI优化AI。作者分享用其优化skill的实践,介绍优化流程,指出可将模糊表述拆成可判断是非题,还提及定义评估标准的方法与常见错误修正。此外,还能用于代码性能优化。
千问App更新之后,所有人都该重估阿里|甲子光年
千问App 6.0版本更新,全面接入阿里生态业务,开放400多项办事功能,面向所有用户测试,成为全球首个能完成复杂生活任务的AI助手。它重构交互逻辑,推动“去App化”,让阿里凭生态优势领跑AI下半场。
提升大模型内在透明度:无需外部模块实现高效监控与自发安全增强|上海AI Lab & 上交
大语言模型能力提升引发风险担忧,当前主流用外部“黑盒”监控模块解读模型表征,存在诸多局限。上海人工智能实验室和上海交通大学团队提出TELLME方法,摒弃外部模块,提升模型内部透明度,还提升了输出安全性。
画数独、烧蜡烛都不翻车了?浙大&阿里让AI先三思再下笔|ACL 2026
当下视觉生成中,开源模型在逻辑推理生成任务上频频翻车,与闭源模型有差距。浙大与阿里团队提出Unified Thinker,将思考与执行解耦,构建数据集、采用创新算法,实验显示其有效提升逻辑执行准确度。
GPT-5终于来了!在惊喜不多的时代,它是否值得我们的等待?|甲子光年
北京时间8月8日凌晨1点,OpenAI正式发布新模型GPT-5。它是目前最强通用模型,在多方面全面进化,将成ChatGPT默认模型。不过它虽有进步,但未掀起革命,GPT系列或难有飞跃,而OpenAI仍规划了未来发展。
全民拜龙?我看是大厂“套壳大战”搞疯了
OpenClaw是开源AI Agent框架,引发全民热潮,中国大厂纷纷推出套壳产品。国产套壳产品上手难度低,但也存在问题。傅盛基于此养出AI团队,猎豹移动市值涨24%。不过,OpenClaw存在安全问题,背后是Token入口争夺战。
视觉+语言+动作!超强具身“训练宝典” EmbRACE-3K
视觉 - 语言模型在具身环境中表现有局限,港大推出 EmbRACE - 3K 数据集应对。它含 3000 多个任务、2.6 万个决策步骤,有细致多模态注释。团队用其微调 Qwen2.5 - VL - 7B 模型,还建立新基准评估多个模型。
Codex跑了22小时,真赚16.88美元:奥特曼预言的「AI打工人」来了
开发者Chris让Codex按「去GitHub上赚5美元」指令运行22小时,几天后获16.88美元。虽流程细节缺验证,但显示Codex在特定条件有「找漏洞→提PR→跟进审查」能力,不过距真正自主赚钱仍有距离。
当10亿个AI一起模拟未来:李飞飞和Karpathy共同押注的新赛道|5Y Research
本文聚焦Multi - Agents模拟预测这一AI前沿方向,介绍其发展、原理、应用场景及代表公司。它能为人类社会建可反复运行的“世界模型”,虽潜力大,但面临验证难、技术瓶颈等问题。
牛芯PCIe IP再进阶:从PCIe 5.0迈向PCIe 6.0,释放AI时代超高速互联潜能
AI大模型发展推动算力对互联带宽需求提升,牛芯半导体完成自研PCIe 6.0 PHY IP研发,构建了覆盖PCIe 3.0到6.0的完整高速互联IP产品矩阵,为国产高端芯片提供自主可控的超高速互联方案,目前已开放客户技术评估。