「大模型技术」共找到 10342 篇相关文章
5款大模型考「山东卷」,Gemini、豆包分别获文理第一名
近日,字节跳动Seed团队用2025年山东高考真题对5款大模型进行全科闭卷测评。结果显示,豆包Seed1.6 - Thinking获文科第一,Gemini 2.5 Pro获理科第一。大模型一年间进步显著,未来或融入更多领域。
揭秘千卡 GPU 集群如何高效训练多模态大模型:vivo AI 团队实战经验分享|AICon
在 InfoQ 举办的 AICon 大会上,vivo AI 架构师王兆雄分享多模态大模型训练经验。介绍了 LLaVA 和 DiT 模型训练挑战,从数据处理、模型计算等方面提出优化策略,还展望 AI Infra 未来发展方向。
大模型热度退潮,真正的技术创新者开始被「看见」
过去两年中国大模型投资多是商业模式驱动,而技术投资注重创新。DeepSeek 出圈后,独立创新成主流。今年国内大模型吸金热度下降,但智谱 AI、面壁智能仍获融资。面壁智能发布 MiniCPM 4.0,在多方面优化,展现端侧优势。
不再“纸上谈兵”:大模型能力如何转化为实际业务价值
InfoQ《极客有约》X AICon 直播栏目邀华为云郑岩、蚂蚁集团杨浩、明略科技吴昊宇,探讨大模型驱动业务提效。分享场景探索、技术落地经验,如选模型考量因素、AI Agent 创新等,还提及 MCP 应用与未来展望。
我让10个大模型又参加了完整版数学高考,第一名居然是它。。。
作者让10个大模型参加完整版数学高考,单独制定规则,邀朋友协助测试。结果令人意外,单选题第6题成噩梦,多模态题大模型几乎全军覆没。讯飞星火和豆包145分并列第一,Qwen3屈居第三。
78%主创跳槽!Llama 14名作者只剩3人,Meta最强开源模型团队大溃散引争议
据外媒消息,Meta面临严重人才流失,Llama模型14位核心作者中11位离职,或自立门户或跳槽。同时,Meta大模型研发进度缓慢,旗舰模型屡次延期,一边裁员一边押注AI,且寻求资金支持遇冷。
图灵奖得主LeCun最后警告Meta!我搞了40年AI,大模型是死路
图灵奖得主Yann LeCun预计将很快离开Meta。因Meta风向转变,LeCun失势。他投身AI研究40年,认为大语言模型是死路,世界模型才是未来,或为此离开Meta并计划创业。
一场对话,我们细扒了下文心大模型背后的技术
信通院大模型推理能力评估中,文心X1 Turbo获最高级“4+级”。百度AI Day上,副总裁吴甜解析文心4.5 Turbo和文心X1 Turbo,从多模态、深度思考等方面介绍技术,还展示其在多场景应用成果。
万亿参数狂欢!一文刷爆2025年七大顶流大模型架构
文章深入剖析2025年顶级开源模型的创新技术,介绍了DeepSeek V3/R1、Kimi 2、Qwen3等七大顶流大模型架构,揭示滑动窗口注意力、MoE和NoPE如何重塑效率与性能。
Chaterm Agent Skills + 千问大模型,智能运维再进化
文章介绍Chaterm Agent Skills与千问大模型结合用于智能运维。它能将运维经验打包成技能,提供三种模式,缩短运维时间。文中还阐述了技能概念、工作原理、技术实现及实战案例,鼓励用户尝试创建技能。