「多模型 Agent」共找到 11003 篇相关文章

新闻资讯8

见证历史!DeepSeek跃居全球第二AI实验室,R1登顶开源王座,R2全网催更

昨晚,DeepSeek官宣R1完成小版本升级,开启「深度思考」功能可体验。其R1-0528性能媲美o3和Gemini 2.5 Pro,还微调了8B模型。DeepSeek成全球第二大AI实验室和开源王者,网友催更R2。

新智元
新闻资讯7

Meta“Token榜”逼疯打工人,一夜烧掉公司几万刀!AI时代Token焦虑越来越离谱

据报道,Meta 公司内网出现 AI token 消费排行榜,追踪超 8.5 万员工 token 使用情况,过去 30 天消耗超 60 万亿 token。这反映“Token 最大化”文化,引发 token 消耗是否等同于生产力的争议。当前 Agent 系统高 token 消耗是补偿机制,应提升使用效率。

AI前线
产品应用8

我用豆包工作做了个学术视频解读生产线

作者尹John分享实操经验,利用豆包工作的云端Agent能力,搭建了从热门论文自动生成学术解读视频的完整自动化生产线,仅需用户少量手机操作即可产出成品,还实现了每日自动选题的定时任务。

AGI Hunt
算法论文8

0.01%参数就能接近全量微调!低数据微调极致省参方案来了 | ACL'26

瑞典隆德大学与Google DeepMind团队研究大模型微调省参方案。发现低数据场景下,微调Value投影中的b(v)比b(q)或b(k)性能更好。该研究已被ACL 2026接收,集成进Hugging Face - PEFT库。

量子位
推荐文章7

别再设计 Prompt,顶尖工程师已经开始写 Loop 了!

2026年6月,“Loop Engineering(循环工程)”一词热门起来。其核心主张是不用再亲自给AI写提示词,而是设计驱动Agent的循环。Anthropic的工程师还写成了完整手册,介绍搭建方法、关键及最佳实践等。

特工宇宙
新闻资讯7

揭秘!腾讯女程序员的上下班生活

“三八”国际妇女节,腾讯程序媛号随机采访女程序员。闫子、语心等多位女程序员分享工作内容、穿搭、兴趣爱好等,还谈及小时候梦想与工作联系,以及对AI影响的看法,最后评论区有福利。

腾讯技术工程
算法论文8

ICDE 2026 | 从匹配困境到推理突破:阿里REG4Rec 激活生成式推荐的个性化潜力

阿里国际智能技术团队提出生成式推荐模型 REG4Rec,从表征学习、训练目标和推理策略层面设计,提升推理能力与稳定性。离线实验表现优,已在 Lazada 部署,带来显著商业收益,成果被 ICDE 2026 接收。

机器之心
新闻资讯8

人均「95后」,账上超十亿美金,MiniMax叩响港股大门

国内AI创业公司MiniMax在港交所刊发招股书,上市进入冲刺阶段。它以全模态技术和产品服务全球用户,营收增长快、亏损收窄,M2模型表现亮眼,且团队年轻高效,此次上市意义非凡。

机器之心
开源动态7

数据与舆情双引擎:DeepAnalyze + BettaFish

DeepAnalyze是面向自主数据科学的大语言模型,能自动完成数据科学任务,支持完整流程、开放式研究且完全开源。还提出两项关键技术。微舆 - BettaFish是舆情分析系统,四类智能体协同工作,有六大核心优势。

带你学AI
开源动态8

HAMi × NVIDIA:GPU 拓扑感知调度实现详解

HAMi社区在v2.7.0版本推出针对NVIDIA GPU的拓扑感知调度功能,解决多卡通信瓶颈。文章深入剖析其设计与实现原理,介绍核心特性、阶段及代码,用双策略寻优算法保障性能与资源健康。

AI前线