中国大模型」共找到 9549 篇相关文章

开源动态8

7B模型对标GPT-4o,全球首个医疗代码生成模型训练平台来了

研究团队发布全球首个医疗代码生成模型训练平台MedAgentGym,提供评估基准和训练生态,提升模型医疗代码生成与推理能力。经其训练的Med - Copilot - 7B达GPT - 4o相当水平,解决医疗AI编程瓶颈。

量子位
新闻资讯7

先验+后验加持,模型能否 hold 住推理预测的现实「溢出」?

多数模型评估基准依赖固定数据集,难测真实推理实力。字节跳动等推出的 FutureX 动态评测基准,将重点移至动态预测能力。实验显示不同模型在不同任务表现有别,模型在现实场景运用仍待优化。

机器之心
推荐文章7

2025 年中丨模型市场分析报告

这是《2025年中丨模型市场分析报告》。指出基础模型塑造计算未来,企业重心转向推理。Anthropic超OpenAI成市场头号玩家,开源模型采用趋缓,企业换模型重性能,AI支出从训练转向推理。

特工宇宙
算法论文8

DeepSeek发布最新论文,5杀手锏让模型训练、推理暴涨

全球著名开源模型平台DeepSeek在huggingface发布超强开源模型V3的论文,从硬件架构和模型设计双视角探讨高效训练和推理,提出DeepSeek - MoE、多头潜在注意力等创新技术,解决内存、计算效率等难题。

AIGC开放社区
算法论文7

姚顺雨署名:模型「现学现卖」能力首次被系统评估,腾讯、复旦联手发布CL-Bench

腾讯混元团队和复旦学研究人员联手推出全新基准测试CL - Bench,系统性评估模型上下文学习能力。测试显示十前沿模型表现不佳,揭示当前模型在该能力上的普遍短板,并指出未来四个探索方向。

AI寒武纪
新闻资讯7

全国首部AI模型私有化部署标准,公开征集起草单位和个人!

模型浪潮下,企业对AI投入加,私有化部署需求凸显,但缺乏成熟实施框架。全国首部AI模型私有化部署标准《人工智能模型私有化部署技术实施与评价指南》应运而生,已聚集30余家单位参编。

AI工程化
开源动态8

打破模型编程「数据污染」与「能力虚胖」困境,Meituan-M17团队构建新一代AI编程评测新标准——OIBench

当前语言模型编程能力评估体系问题多,如评测集饱和、数据泄漏等。Meituan - M17团队推出OIBench数据集,对18个主流模型评测,揭示模型真实水平,还将举办人机协作编程竞赛。

机器之心
开源动态8

中科院类脑模型SpikingBrain,2%数据,百倍速度

中国科学院自动化研究所李国齐、徐波团队发布全球首款规模类脑脉冲模型SpikingBrain 1.0。它处理长文本比主流Transformer模型快超百倍,训练数据仅为2%。该模型采用新架构,降低计算复杂度,还可转换现有模型,且在国产GPU完成训练。

AIGC开放社区
新闻资讯7

模型玩不好数独?!Transformer作者初创公司公布排行榜:o3 Mini High“变异数独”正确率仅2.9%

Transformer作者初创公司Sakana AI公布AI解决数独能力排行榜,用全新基准Sudoku - Bench考验模型创造性推理能力。结果显示模型总体正确率仅15%,9×9数独中高性能模型o3 Mini High正确率2.9%。

量子位
新闻资讯7

LeCun离职后不止创一份业!押注与模型不同的路线,加入硅谷初创董事会

离开Meta后,Yann LeCun创立AMI,还加入Logical Intelligence任技术研究委员会主席。该公司推能量 - 推理模型,与主流模型路线不同,其Kona模型在数独测试上表现远超模型

量子位