「多智能体模式」共找到 7062 篇相关文章
斯坦福意外用AI生成超强CUDA内核,性能比人类专家优化得还要好!翻倍碾压原生PyTorch,华人主创
斯坦福团队意外发现AI生成的内核性能超人类专家优化的,在常见深度学习操作上能让性能提升近400%。其方法是生成自然语言优化思想再转化为代码,还使用多分支探索模式。
独家 | 华为天才少年楼燚航离职创业,要做 200B 以上的「具身大脑」
前华为“天才少年”楼燚航离职创立引力蓝移,定位构建具身大脑。其采用分层架构,认为具身智能Scaling拐点已至,规划了数据来源和模型参数规模。正与汇川合作,按24个月规划推进,面临产品验证挑战。
因果发现大模型迎来「理论破局」: DAG-FM 破解异质机制下的因果图识别与涌现难题 | GAIR Paper 116
浙大、清华与稳准智能联合发布因果发现大模型DAG - FM,解决了现有模型缺乏理论基础、易产生非法环路和显存爆炸问题。它在理论上证明因果图可识别,架构上避免环路,处理数据能力强,还将推进特定领域预训练。
从零开始玩转循环 (Getting started with loops)【译】
Claude Code团队将“循环”定义为AI智能体不断重复执行工作周期,直至满足预设停止条件。文章介绍了回合制、目标导向、基于时间和主动式四种循环类型、适用场景及控制token消耗方法,还给出保证代码质量的原则。
独家|「中科第五纪」完成数亿元A轮融资,率先开启海外商业落地
AI科技评论独家消息,具身智能企业「中科第五纪」近日完成数亿元A轮融资,年内已完成三轮。该公司还收获海外数亿订单。其提出超少样本具身操作大模型等核心技术,形成完整技术体系。
米哈游一夜烧掉200万元Token,大厂高管也开始质疑:Token烧不出价值,但养肥了谁?
Uber运营负责人质疑AI tokenmaxxing成本合理性,米哈游员工一晚烧200万Token。部分公司开始调整,如多邻国取消AI使用绩效评估,Shopify阻止失控消耗。Tokenmaxxing让模型厂商、编程工具和算力相关方受益,盲目跟风企业或成输家。
刚刚,DeepSeek多模态技术范式公布,以视觉原语思考
DeepSeek发布多模态模型并公布技术报告,提出‘以视觉原语思考’。该模型解决多模态大模型‘指代鸿沟’问题,有把坐标变思维单元、7056倍视觉压缩、精心设计冷启动数据等创新,实验在多任务上超主流模型。
Token 新译名:「智元」
文章讨论Token新译名「智元」,认为其比「词元」更合适。介绍英伟达GTC 2026上黄仁勋强调AI推理时代智元重要性,OpenClaw消耗大量智元引争议,还提及黄仁勋闭门会观点及多位大佬对「智元」译名的认可。
重新思考RLVR中的熵正则:从探索不足到探索过度的破局之路
2024年以来,RLVR使大模型在推理任务有显著突破,但实践中探索机制易失衡。传统熵正则化在LRM场景易走向极端,研究团队提出SIREN方法精准调控探索,实验显示其在多模型和数据集上性能提升显著。
一年成爆款,狂斩 49.1k Star、200 万下载:Cline 不是开源 Cursor,却更胜一筹?!
AI编程助手市场看似火热,实则盈利艰难,如Cursor等工具亏本运营。Cline选择开源,坚持软件免费、服务变现,一年成爆款。其创始人分享了产品理念、技术选型、市场定位等,还探讨了MCP生态、编程智能体发展等话题。