「大小模型协同」共找到 8102 篇相关文章
从润建、软通、新华三等头部服务商,看IT巨头AI转型的新共识|甲子光年
文章以润建股份为例,探讨传统 IT 服务商 AI 转型。润建以“曲尺”平台为支点转型,其平台覆盖全流程,“曲尺运维大模型”赋能运维。此外,软通动力、新华三也有类似转型,均结合自身优势掌握主动权。
DeepSeek R2没来,Kimi K2来了,VLLM,SGLang首发支持
Moonshot AI发布Kimi K2大语言模型,采用混合专家架构,总参数量达1万亿。其有多项技术创新,在多个基准测试表现突出。发布两版本,用修改版MIT协议开源,vLLM、SGlang首发支持,已上线多服务。
为什么我觉得AGI并不会马上到来
作者Dwarkesh Patel认为AGI不会马上到来。当前大语言模型缺乏持续学习能力,难以替代人类工作;计算机操作能力受训练周期、数据等限制;推理能力虽有突破,但仍需时间发展。作者给出了具体预测时间。
“如果你不用更多Token,就永远逃不出底层”:AI竞赛开始变成资源战争
文章围绕AI竞赛中资源分配问题展开,以SemiAnalysis创始人Dylan Patel经历为例,揭示Token成本疯涨、需求远超供给,介绍Anthropic模型优势,探讨具身智能成新需求点,分析竞争格局及供应链瓶颈,还预警反AI抗议。
玩转智能体协议:谷歌开发指南教你拼出工业级AI应用
谷歌两篇开发指南拆解六大前沿开放协议核心代码,从开发者挑战赛提炼五条架构法则。介绍各协议用途,如MCP消除重复劳动,A2A规范智能体通信等,阐述协议协同运作及架构法则助力工业级智能体应用开发。
死敌爆料是狠!OpenAI内部信阴阳Claude营收注水80亿,然后泄露了…
OpenAI首席营收官Denise Dresser给员工的内部信被泄露,信中透露Q2企业业务方向,还贬低对手Anthropic,称其300亿年化营收虚高80亿。此外,还提及OpenAI未来计划,如推新模型Spud、与Amazon合作等。
零Token部署GraphRAG,LinearRAG做到了~
现有GraphRAG模型在实际应用中常不如朴素RAG,原因是自动构建的知识图谱质量不佳。LinearRAG框架通过Tri - Graph架构、两阶段精准检索和零Token范式重构GraphRAG,在多数据集上超越现有方法,代码和数据已开源。
让机器人「不仅会想,还能准确去做」,VLA-R1把「推理+行动」带进真实世界
VLA-R1是“先推理、后执行”的VLA基础模型,结合链式思维监督与强化学习,优化推理和执行。它有两阶段训练、三类可验证奖励等创新点,经多层面测试效果好,在多领域有应用前景。
Data Agent 落地挑战:忽略技术框架、语义能力和运营体系,投入可能打水漂
Data Agent 落地挑战大,90% 难点源于软件工程,统一语义层建设是关键。企业若忽略场景聚焦、技术框架迭代能力、语义模型和运营体系,投入可能打水漂。掌握相关要素,才能让 AI 代理落地应用,提升企业数据智能化效率。
刚刚,Gemini 宣布将前往太空!
刚刚,Starcloud宣布与Google Cloud合作,要把Gemini模型送上卫星运行。计划今年底或明年初通过SpaceX发射搭载NVIDIA H100 GPU的演示卫星。虽面临诸多技术难题,但在AI算力需求增长下,此举或开启新时代。