大模型开源」共找到 10086 篇相关文章

开源动态8

Issue修复开源No.1!蚂蚁 | 提出代码图模型:CGM,结合GraphRAG架构,领先最强开源7.33%

为解决开源模型在仓库级代码理解上的能力瓶颈,蚂蚁全模态代码算法团队提出 CGM 架构,融合仓库结构与语义信息。CGM 首创图结构与语言模型融合的对齐框架,还搭配了 GraphRAG 框架,在多个代码任务中表现出色,且相关资源均已开源

AINLPer
新闻资讯7

对话地平线前高管牛建伟:万亿参数模型如何重塑具身智能

具身智能赛道分“VLA派”“智驾降维派”和“模型派”。地平线前高管牛建伟认为VLA是弯路,主张用分层架构,以万亿参数“空间智能模型”做脑,VA小模型执行操作,目标是做物理世界的OpenClaw。

AI科技评论
推荐文章8

林俊旸离职后首度发声:万字复盘,模型下一站「智能体式思考」

前阿里千问负责人林俊旸离职后发文,复盘模型行业演进,指出 AI 模型未来主线是智能体式思考。文中分析推理模型崛起的启示,探讨思考与指令融合难题,还阐述智能体式思维含义、强化学习基础设施挑战等。

机器之心
开源动态8

超越O4-mini,多模态模型终于学会回头「看」:中科院自动化所提出GThinker模型

现有多模态模型在通用场景推理有瓶颈,缺乏对视觉线索校验与再思考能力。中科院自动化所提出GThinker模型,有创新的「线索引导式反思」模式,经两阶段训练,性能超O4 - mini,论文等已开源

机器之心
开源动态8

7B模型对标GPT-4o,全球首个医疗代码生成模型训练平台来了

研究团队发布全球首个医疗代码生成模型训练平台MedAgentGym,提供评估基准和训练生态,提升模型医疗代码生成与推理能力。经其训练的Med - Copilot - 7B达GPT - 4o相当水平,解决医疗AI编程瓶颈。

量子位
新闻资讯7

先验+后验加持,模型能否 hold 住推理预测的现实「溢出」?

多数模型评估基准依赖固定数据集,难测真实推理实力。字节跳动等推出的 FutureX 动态评测基准,将重点移至动态预测能力。实验显示不同模型在不同任务表现有别,模型在现实场景运用仍待优化。

机器之心
算法论文7

姚顺雨署名:模型「现学现卖」能力首次被系统评估,腾讯、复旦联手发布CL-Bench

腾讯混元团队和复旦学研究人员联手推出全新基准测试CL - Bench,系统性评估模型上下文学习能力。测试显示十前沿模型表现不佳,揭示当前模型在该能力上的普遍短板,并指出未来四个探索方向。

AI寒武纪
开源动态7

宇树:开源机器人世界模型

宇树开源世界模型 - 动作架构UnifoLM - WMA - 0,它属UnifoLM系列,适配多机器人本体。真机部署表现出色,预测与实际操作吻合。官方介绍训练策略,代码开源后GitHub获100 + Star。

量子位
开源动态8

打破模型编程「数据污染」与「能力虚胖」困境,Meituan-M17团队构建新一代AI编程评测新标准——OIBench

当前语言模型编程能力评估体系问题多,如评测集饱和、数据泄漏等。Meituan - M17团队推出OIBench数据集,对18个主流模型评测,揭示模型真实水平,还将举办人机协作编程竞赛。

机器之心
开源动态8

性能涨!阿里开源新版Qwen3模型,霸榜文本表征

今日凌晨阿里开源Qwen3-Embedding和Qwen3-Reranker两款新模型,专为文本表征等任务设计,支持119种语言。测试显示其性能出色,在多语言文本表征和排序任务中超越众多模型,还采用了多种创新设计与训练方法。

AIGC开放社区