「多模型 Agent」共找到 11003 篇相关文章
见证历史!DeepSeek跃居全球第二AI实验室,R1登顶开源王座,R2全网催更
昨晚,DeepSeek官宣R1完成小版本升级,开启「深度思考」功能可体验。其R1-0528性能媲美o3和Gemini 2.5 Pro,还微调了8B模型。DeepSeek成全球第二大AI实验室和开源王者,网友催更R2。
Meta“Token榜”逼疯打工人,一夜烧掉公司几万刀!AI时代Token焦虑越来越离谱
据报道,Meta 公司内网出现 AI token 消费排行榜,追踪超 8.5 万员工 token 使用情况,过去 30 天消耗超 60 万亿 token。这反映“Token 最大化”文化,引发 token 消耗是否等同于生产力的争议。当前 Agent 系统高 token 消耗是补偿机制,应提升使用效率。
我用豆包工作做了个学术视频解读生产线
作者尹John分享实操经验,利用豆包工作的云端Agent能力,搭建了从热门论文自动生成学术解读视频的完整自动化生产线,仅需用户少量手机操作即可产出成品,还实现了每日自动选题的定时任务。
0.01%参数就能接近全量微调!低数据微调极致省参方案来了 | ACL'26
瑞典隆德大学与Google DeepMind团队研究大模型微调省参方案。发现低数据场景下,微调Value投影中的b(v)比b(q)或b(k)性能更好。该研究已被ACL 2026接收,集成进Hugging Face - PEFT库。
别再设计 Prompt,顶尖工程师已经开始写 Loop 了!
2026年6月,“Loop Engineering(循环工程)”一词热门起来。其核心主张是不用再亲自给AI写提示词,而是设计驱动Agent的循环。Anthropic的工程师还写成了完整手册,介绍搭建方法、关键及最佳实践等。
揭秘!腾讯女程序员的上下班生活
“三八”国际妇女节,腾讯程序媛号随机采访女程序员。闫子、语心等多位女程序员分享工作内容、穿搭、兴趣爱好等,还谈及小时候梦想与工作联系,以及对AI影响的看法,最后评论区有福利。
ICDE 2026 | 从匹配困境到推理突破:阿里REG4Rec 激活生成式推荐的个性化潜力
阿里国际智能技术团队提出生成式推荐模型 REG4Rec,从表征学习、训练目标和推理策略层面设计,提升推理能力与稳定性。离线实验表现优,已在 Lazada 部署,带来显著商业收益,成果被 ICDE 2026 接收。
人均「95后」,账上超十亿美金,MiniMax叩响港股大门
国内AI创业公司MiniMax在港交所刊发招股书,上市进入冲刺阶段。它以全模态技术和产品服务全球用户,营收增长快、亏损收窄,M2模型表现亮眼,且团队年轻高效,此次上市意义非凡。
数据与舆情双引擎:DeepAnalyze + BettaFish
DeepAnalyze是面向自主数据科学的大语言模型,能自动完成数据科学任务,支持完整流程、开放式研究且完全开源。还提出两项关键技术。微舆 - BettaFish是舆情分析系统,四类智能体协同工作,有六大核心优势。
HAMi × NVIDIA:GPU 拓扑感知调度实现详解
HAMi社区在v2.7.0版本推出针对NVIDIA GPU的拓扑感知调度功能,解决多卡通信瓶颈。文章深入剖析其设计与实现原理,介绍核心特性、阶段及代码,用双策略寻优算法保障性能与资源健康。