开源大模型」共找到 10160 篇相关文章

算法论文8

九成以上模型止步白银段位,只有3个铂金!通用AI下半场评测标准来了

OpenAI研究员姚顺雨提出AI发展步入新阶段,下半场关键在评估模型真实智能。新加坡国立学等团队提出“通才智能”评测框架,剖析多模态模型短板,推出五级评估体系和测试集,测试结果暴露模型弱点,引发社区积极反响。

机器之心
算法论文8

给GRPO加上运筹外挂让7B模型比肩GPT-4!Li Auto团队发布多目标强化学习新框架 | ICASSP 2026

文本摘要质量评估需兼顾多维度,但开发者优化时易顾此失彼。Li Auto团队提出HVO,基于GRPO框架,让7B模型在摘要任务媲美GPT - 4,且生成内容更简洁,成果被ICASSP 2026接收。

量子位
开源动态8

消费级显卡可以快速上手跑!面壁智能MiniCPM-o 4.5发技术报告

面壁智能联合多方发布MiniCPM-o 4.5技术报告。该模型是业界首个端到端全双工全模态模型,参数约9B,依托Omni - Flow框架,多项性能对标前沿模型,还推出多种使用方式,兼顾普通用户与开发者需求。

量子位
算法论文8

抗干扰能力提升近40% !无需对抗训练,北航上海AI Lab新蒸馏方法提升模型鲁棒性 | ICML 2025

在人工智能模型规模持续扩的今天,数据集蒸馏方法能提升训练效率、降低成本,但蒸馏模型在安全性要求高的任务中抗干扰难。北航上海AI Lab团队提出ROME方法,无需对抗训练,显著提升模型鲁棒性,成果被ICML 2025接收且已开源

量子位
新闻资讯7

研究表明,开源能推动AI创新和经济增长

Siliconangle消息,Linux基金会新研究显示开源对全球经济贡献达9万亿美元。其首席经济学家Frank Nagle指出,AI加入使开源价值评估方式改变,计算开源AI价值复杂,参与开源项目能增加经济价值。

AIGC开放社区
新闻资讯7

美国AI一骑绝尘,中国平均落后7个月!Epoch AI新报告出炉

Epoch AI报告指出,中国AI模型进展平均落后美国7个月,最小4个月,最14个月。这差距本质是「开源vs闭源」差距,中国领先模型开源,美国前沿模型均闭源。不过中国AI追赶速度稳定。

新智元
新闻资讯8

OpenAI和Anthropic罕见互评模型:Claude幻觉明显要低

OpenAI和Anthropic罕见合作,互相授予API权限评估模型安全与对齐情况并发布报告。双方派出多模型参与,从指令层次、越狱、幻觉、欺骗策略等方面评测,呈现各模型优缺点。

量子位
开源动态8

AI点外卖哪家强,美团LongCat团队做了个全面评测

美团LongCat团队发布贴近生活场景的模型智能体评测基准VitaBench,以三高频生活场景为载体,构建含66个工具的评测环境。评测显示现有智能体与应用需求差距,该基准已全面开源

量子位
产品应用8

Nature报道:谷歌新模型1秒读懂DNA变异!首次统一基因组全任务,性能碾压现有模型

谷歌DeepMind团队推出生物模型AlphaGenome,能从1兆碱基DNA序列中预测数千种功能基因组特征,评估变异效应。它统一多任务,性能超现有模型,是生物领域里程碑,将助力理解疾病。

量子位
产品应用7

抢先李飞飞!世界模型能多人联机玩FPS游戏了

Odyssey公司推出世界模型Agora - 1,驱动网页版多人FPS游戏,无游戏引擎等,画面实时生成。该公司专注通用世界模型,此前业务转向主动交互,此成果解决多人游戏一致性难题,还发布多模态模型Starchild - 1。

量子位