「大规模智能体系统」共找到 4131 篇相关文章
智源技术分享:大模型行业应用新模式和关键实现路径
在 AICon 大会上,智源研究院周华分享大模型行业应用。分析落地问题,提出以大模型为核心的技术路径,涵盖数据、训练等环节,还给出数据生产流程建议,分享最新开源成果。
前荣耀AI实验室主任带队:用“超级大脑”接管农场,24小时不打烊
浙江丘沃智能的AlphaFarm系统开启无人农场新范式,由前荣耀AI实验室主任汤泳等“AI极客”打造。该系统能自主决策执行、实时监控,有四大黑科技,经评估在农业垂直领域领先。
腾讯纯文本LLM训视觉encoder,拿捏图表长视频,达到开源小模型SOTA!
腾讯开源Penguin - VL,直接用纯文本LLM训视觉编码器,跳出传统多模态拼接套路。在2B/8B紧凑参数规模的复杂任务中竞争力强,训练分三阶段,相关代码、模型等已开放。
视觉强≠能干活!清北普林斯顿等开源WorldArena,世界模型评测被颠覆
2026 年 2 月 13 日,清华、北大等顶尖机构联合推出的 WorldArena 面向全球开源。这是首个‘功能 + 视觉’统一评测体系,撕开了‘美丽视频’伪装,让评测从‘审美导向’走向‘功能导向’。
清华AI找药登Science!一天筛选10万亿次,解决AlphaFold到药物发现的最后一公里
清华大学团队在Science发表论文,研发AI驱动的超高通量药物虚拟筛选平台DrugCLIP。它24小时能完成10万亿次蛋白–分子配对计算,打通从AlphaFold到药物发现通道,完成人类基因组规模筛选,数据已开放。
ICCV 2025最佳论文出炉!何恺明、孙剑等十年经典之作夺奖
ICCV 2025公布奖项,CMU团队凭BrickGPT获最佳论文,以色列理工学院团队FlowEdit获最佳学生论文。何恺明等十年前论文获Helmholtz Prize。大会规模超往届,投稿11239篇,录用2500 + ,超半作者来自中国。
前 DeepMind 研究员反思:评测,而非算力或数据,才是下一阶段的瓶颈
前 Google DeepMind 高级研究员 Lun Wang 在技术长文中指出,当前主流评测体系滞后,静态基准会“安静失效”。作者主张引入序参量,呼吁构建自演进评测,还为一线工程师提供了研发建议。
Claude Code 之父分享 10 大使用技巧
Claude Code 创造者 Boris Cherny 分享团队使用技巧,如并行工作、先规划再动手、更新 CLAUDE.md 等 10 条经验,还提及打造自动化体系、提升 Prompt 水平等内容,强调多用多想提效。
刚刚,DeepSeek官宣V3.1发布,Agent 能力较大提升
DeepSeek官宣V3.1发布,核心特性有混合推理架构、思考效率提升、Agent能力增强。产品形态含官方App/网页端和API升级。性能在编程、搜索智能体及思考效率上显著提升。
一键分享=全网公开?Claude 被曝聊天记录可在谷歌直接搜到
2026 年 7 月 26 日,Reddit 用户称用谷歌站点检索语法能调出 Claude 用户共享对话记录。因 Claude 未补全防护配置,致用户加密资产、身份等信息泄露。此前 OpenAI、Grok 也有同类问题,社区呼吁平台完善防护体系。