大模型测试」共找到 9649 篇相关文章

产品应用8

模型测试不再跳来跳去,VS Code + Hugging Face = 真香

Hugging Face 发布新功能,让开发者在 VS Code 的 GitHub Copilot Chat 中直接接入 Inference Providers,可调用 Kimi K2 等开源大模型测试,无需频繁切换平台。该功能有统一 API 等优势,定价门槛低。

InfoQ
新闻资讯8

5款模型考「山东卷」,Gemini、豆包分别获文理第一名

近日,字节跳动Seed团队用2025年山东高考真题对5款模型进行全科闭卷测评。结果显示,豆包Seed1.6 - Thinking获文科第一,Gemini 2.5 Pro获理科第一。模型一年间进步显著,未来或融入更多领域。

机器之心
推荐文章7

万字长文!模型LLM推理优化技术总结

文章围绕模型LLM推理优化技术展开,先介绍LLM推理各阶段、批处理、KV缓存等概念及内存需求,再阐述模型并行、注意力机制优化、模型优化和模型服务等技术,如Pipeline并行、MQA、量化、动态批处理等。

OpenMMLab
推荐文章8

揭秘千卡 GPU 集群如何高效训练多模态模型:vivo AI 团队实战经验分享|AICon

在 InfoQ 举办的 AICon 会上,vivo AI 架构师王兆雄分享多模态模型训练经验。介绍了 LLaVA 和 DiT 模型训练挑战,从数据处理、模型计算等方面提出优化策略,还展望 AI Infra 未来发展方向。

AI前线
算法论文7

模型也需要睡觉!让AI打个盹,醒来更聪明

卡内基梅隆学和马里兰学研究发现,模型处理长上下文易累傻。受人脑机制启发,设计睡眠机制,让模型在上下文窗口快满时打盹,反复咀嚼信息,压缩进长期权重。测试显示,增加“睡眠”轮次能提升深度推理表现。

量子位
新闻资讯7

78%主创跳槽!Llama 14名作者只剩3人,Meta最强开源模型团队溃散引争议

据外媒消息,Meta面临严重人才流失,Llama模型14位核心作者中11位离职,或自立门户或跳槽。同时,Meta模型研发进度缓慢,旗舰模型屡次延期,一边裁员一边押注AI,且寻求资金支持遇冷。

AI科技大本营
新闻资讯8

图灵奖得主LeCun最后警告Meta!我搞了40年AI,模型是死路

图灵奖得主Yann LeCun预计将很快离开Meta。因Meta风向转变,LeCun失势。他投身AI研究40年,认为语言模型是死路,世界模型才是未来,或为此离开Meta并计划创业。

新智元
算法论文7

让推荐学会思考:用强化学习激活模型的序列推理能力

文章指出推荐系统曾未紧密结合模型能力,如今正靠近其训练范式。作者基于用户行为序列,用强化学习训练模型理解序列关系,以预测用户下一个可能点击的资讯,并通过实验验证了该方法的可行性,还探讨了不同数据库中BM25算法的差异。

AI科技评论
新闻资讯7

MMAR与AudioTrust技术解读,音频模型评测前沿进展分享 | AI Bench Talk直播预告

司南评测集社区 CompassHub 收录多维度评测集。此次 AI Bench Talk 直播聚焦音频模型,将分享评估其深度推理能力的 MMAR 及全方位可信评估框架 AudioTrust,还设圆桌讨论多模态/音频模型相关议题。

OpenMMLab
算法论文8

陈丹琦新作:模型强化学习的第三条路,8B小模型超越GPT-4o

陈丹琦团队提出结合RLHF和RLVR优点的RLMT方法,支持在基础模型上直接使用,节省后训练成本。它让模型生成CoT,用奖励模型评价输出,使小模型超越模型,推理更像人类。

量子位