「协作评估」共找到 1193 篇相关文章
Agent群体智能来了!魔搭开源Agent自进化群体智能框架:群体记忆自动蒸馏与进化,8万+群体技能即取即用,智能体画像一键复用
个人或团队部署使用智能体面临状态易失、重复试错、迁移困难等痛点。魔搭ModelScope团队开源的Ultron框架,补上群体协作基础设施,解决经验沉淀、技能进化和画像共享问题,提升智能体协作效率。
医疗AI质变时刻来临!国产医疗AI率先突破,临床诊疗能力问鼎全球
文章指出当前医疗AI真实能力与临床期待有落差,为此中国医生联合制定全球首个评估医疗AI临床适用性标准,完成对主流模型测评,中国企业打造的MedGPT夺冠,还推出‘未来医生’平台服务患者。
单Agent时代正式结束:一个干不过,就上300个
月之暗面发布并开源 Kimi K2.6 模型,热度高。它强化 Agent 团队协作能力,核心能力进步,领先对手。在编程领域发力,长程编码能力突破,集群协同输出强,还适配框架,实测效果出色,Claw 群组开启内测。
将DSA注意力引入多模态,快手Keye2.0开启强化推理新范式
快手发布新版多模态大模型Keye-VL-2.0-30B-A3B,率先将DSA机制引入多模态理解场景,解锁256K超长上下文深度感知,还首次解锁Agent协作机制。该模型在多方面表现出色,且将融入业务带来收益。
不再迷信Hackathon,把Agent推翻重做了4次!Notion负责人复盘:做AI产品如何避免“逆流而上”?
Notion负责人复盘Agent开发历程,指出AI替代的是流程。他们将模型、产品和权限接入同一框架,历经多次重构,还探讨了组织管理、评估体系、软件工厂等内容,分享对CLI和MCP的看法及产品定价策略。
专治AI生图「人脸崩坏」,8倍速碾压GPT!新版FLUX.1多方位刷新SOTA
FLUX.1 Kontext是融合即时文本图像编辑与文本到图像生成的新一代模型,支持文本与图像提示,角色一致性强,速度快达GPT - Image - 1的8倍。它能解决AI生图“人脸崩坏”等问题,评估显示性能优异。
阿里开源 Team 版 OpenClaw,5分钟完成本地安装
阿里开源 Team 版 OpenClaw——HiClaw,它是 OpenClaw 超进化版,引入 Manager Agent 角色,解决了 OpenClaw 在安全、多任务协作、移动端体验、记忆管理等方面的痛点,还集成多个开源组件,部署简单,适合开发者和企业。
一个“蠢问题”改写模型规则!Anthropic联创亲曝:瞄准Claude 5开发爆款应用,最强模型的价值会让人忽略成本负担
Anthropic联合创始人Jared Kaplan在YC分享Scaling Law对大模型发展的影响及对Claude等模型的意义。他认为AI发展不平衡,建议构建未完全跑通的产品,还介绍了Claude 4优化,探讨人机协作等内容。
Altman 嘲讽 Meta 挖走的不是顶尖人才,OpenAI 高管首曝内幕:ChatGPT 如何让我们一夜“封神”
AI 领域人才抢夺激烈,Meta 招募 AI 人才触动 OpenAI。OpenAI CEO Altman 嘲讽 Meta 没挖到顶尖人才,还透露正评估薪酬。同时,OpenAI 播客揭秘 ChatGPT 幕后,包括名称由来、传播、内部辩论等,也谈到模型问题及应对。
Anthropic:我们如何构建多智能体研究系统
Anthropic分享构建多智能体研究系统的经验,该系统用多个Claude智能体探索复杂主题。介绍了多智能体系统优势、架构、提示工程、评估方法,也提及生产环境的挑战,此系统处理开放式研究任务价值大。