「开源大语言模型」共找到 9112 篇相关文章
00后挑大梁!近20国选手激战外滩大会,AI科创赛三赛道冠军诞生
9月10日,2025外滩大会AI科创赛在上海落幕,设三大核心赛事,80个项目获奖。00后成主力,近20国选手参与。大赛提供资源支持,AI硬件赛受青睐,金融与安全赛道涌现创新方案,还开源数据集。
三大核心创新公开,快手开源多模态Keye-VL 1.5拿下视频理解SOTA,8B力压GPT-4o!
快手开源多模态Keye-VL 1.5,为8B视频理解大模型,公开3大核心创新技术。靠Slow - Fast视频编码等,在20 + 基准屠榜。它能精确视频定位,实验显示通用、视频理解和数学推理表现佳。
Claude不让我们用!国产平替能顶上吗?
全球AI代码生成竞争格局生变,Anthropic地位动摇,一是OpenAI GPT - 5崛起,二是自身迷之操作。此时国产大模型发力,如Kimi - K2 - 0905、Qwen3 - Max - Preview,性能和价格有优势,有望改变竞争格局。
Hinton与姚期智对谈:认为人类的意识特殊,那是危险的无稽之谈
图灵奖得主Geoffery Hinton与姚期智对谈AI相关话题。Hinton认为人脑可给AI借鉴,还探讨人类未来与AI道德,强调训练善良AI重要;他觉得大模型有理解能力,将人类意识特殊化是危险无稽之谈。
没有老黄不夸的中国公司了吧??
英伟达CEO黄仁勋访华期间,在高密度采访交流中对中国公司、技术赞不绝口。他夸雷军和小米,评蔚小理、华为、DeepSeek等,还看好中国大模型、机器人等领域,此外也谈及英伟达合作、AI发展等问题。
AI4Science 图谱,如何颠覆10年 x 20亿美金成本的药物研发模式
文章指出AI for Science让生命科学与数字互联网融合,加速科学发现。以四象限为框架,梳理了Biology Foundation Model、AI Scientist等玩家,介绍相关模型和公司,展示其对药物研发流程的重塑。
假如有一万张卡,RL训练该怎么扩大规模?十万张呢?
本文是腾讯混元团队针对大模型强化学习规模化训练的研究,聚焦万卡级算力下Batch Size优化问题,拆分样本效率与系统效率的影响,给出可落地的调优框架,实测可缩短29%训练时间。
别再无脑开高推理!Opus 5高配会擅自重构代码乱加戏
有人用FrontierCode编程基准测试Opus 5推理档位,发现性能顶峰在medium档,高档位推理预算多余,会让模型反复校验、偏离需求,在代码场景还会擅自重构代码。Anthropic也建议调低推理档位。
【AAAI 2026大会特邀报告】从推理到科学发现:AI迈向可精专通才之路
上海人工智能实验室周伯文在AAAI 2026大会提出,当前处于AGI前夕,需通专融合智能。他认为可深度专业化通用模型是实现AGI的可行路径,科学发现是AI前沿,还介绍了SAGE架构及相关成果。
AI 医疗还在比进度,百川已在比高度
近一年来,AI医疗进入新阶段,众多企业和资本涌入。但当前主流医疗大模型有局限,落地难。百川Baichuan - M3聚焦医疗决策过程建模,三项关键评测达全球最优,或代表AI医疗重要转向。