「多模型 Agent」共找到 11003 篇相关文章

开源动态8

让AI自己“炼数据”!DataChef开源:用强化学习自动生成LLM数据配方

上海人工智能实验室联合复旦大学开源DataChef,它能通过在线强化学习自动生成LLM数据配方。实验显示其能力逼近Gemini - 3 - Pro,超越人类专家设计算法,解决传统数据工程难题,推动大模型数据工程迈向新范式。

OpenMMLab
产品应用8

Claude Sonnet 4.5被炸出来了,依旧最强编程,连续30小时自主运行写代码

新发布的Claude Sonnet 4.5在SWE - bench等多项测试中成绩提升,能连续30小时自主写代码,还改善了对齐和安全性指标,且提质不加价。此外,Anthropic官宣Claude Agent SDK,发布Imagine with Claude功能。

量子位
开源动态8

Github 4.1k star,SuperSonic AI×BI 大厂震撼开源

SuperSonic 是腾讯音乐开源的下一代 AI+BI 平台,融合 Chat BI 与 Headless BI 两种范式。它解决了传统 BI 工具复杂、数据口径不统一等痛点,有丰富功能和技术优势,适用于多业务场景,开源优势明显。

小华同学ai
产品应用7

10万智能体同场模拟,YuLan-OneSim带来真正的大社会实验

YuLan-OneSim是大语言模型驱动的社会模拟器,能模拟人类社会行为。它可零代码构建场景,有50个默认场景,具分布式架构,支持10万智能体同场模拟,还推出AI社会研究员,自动完成社会科学研究流程。

带你学AI
产品应用7

Claude后台接管电脑,真·赛博替身!人机并行时代来了

Anthropic宣布全面升级Claude「计算机使用」能力,操作可在后台完成。该功能处于Beta测试,已向Claude Pro和Max订阅的macOS用户开放。Claude此次更新覆盖多场景,人机并行时代或来临。

新智元
产品应用7

我给剪辑产品 0 元雇了个外部研发部:它开始自进化

作者的剪辑产品有了“外部研发部”——Agent。它每天研究新方法、用真实项目测试。作者三步搭建此“研发部”,让其自动查询、测试和汇报,自己负责最终决策,项目获取新方法不再只靠偶然。

AI产品自由
新闻资讯8

王阳明心学,被Anthropic用来教Claude做人了

UT Austin哲学教授Harvey Lederman研究王阳明心学十年,现加入Anthropic做Claude对齐训练。他用分析哲学拆解“知行合一”,发现AI模型存在“信念冲突”,Anthropic用类似阳明心学方法解决问题。如今硅谷AI公司争抢哲学家。

量子位
新闻资讯7

OpenClaw危了?Claude Code迎来最激进升级:AI 开始直接操控电脑,正面挑战 OpenAI

北京时间昨日夜里,Anthropic 宣布对旗下 Claude Code 与 Claude Cowork 进行关键更新,AI 可直接操控电脑。同日 OpenClaw 也迎来重大更新,重构插件系统、升级模型等。二者更新引发关注,各有优劣。

InfoQ
新闻资讯7

突发!阿里Qwen深夜地震,林俊旸官宣「下台离开」

深夜,Qwen负责人林俊旸宣布离开Qwen团队,未透露去向和接任者。他是阿里最年轻P10技术高管,跨学科背景,在阿里6年连升四级,推动Qwen开源模型发展,还关注AI未来。

机器之心
算法论文7

Anthropic 新研究:AI出错是“热混乱”

Anthropic研究团队发现AI可能无一致目标,只是瞎搞。他们将AI错误分类,测试发现推理越久越混乱,大模型复杂任务易失控。此发现改变对AI风险的认知,论文已在arXiv发布。

AI工程化