AI模型性能」共找到 13755 篇相关文章

开源动态8

京东AI一揽子开源!超多核心项目全开源,GitHub万star项目也有新进展了

京东系统性开源系列AI能力,从大模型到Agent等。JoyAgent 3.0升级,开源DataAgent和DCP模块;OxyGent多智能体框架让开发者自由组合。还有京医千询2.0等,意在推动AI在各行业落地。

量子位
新闻资讯7

苹果庞若鸣也被小扎挖走!Meta AI天团开会直接用中文吧

Meta超级AI实验室内部交流可用中文,苹果基础模型团队负责人庞若鸣被其挖走。Meta还从OpenAI和Anthropic各挖一人。目前其AI天团14人名单中9个是华人,苹果AI进展堪忧。

量子位
算法论文8

只要9美元!LoRA+强化学习,DeepSeek 1.5B推理性能暴涨20%

南加州大学团队基于LoRA的强化学习训练1.5B推理模型,在AIME 24测试上性能提升超20%,成本仅9美元。开源Tina模型结合三大关键技术,与SOTA模型相比竞争力强,研究者还对其有效性提出假设。

新智元
开源动态8

不用人类手写训练框架了!AI自己写代码,训出1B端侧「小钢炮」

5月25日,面壁开源端侧文本基座大模型MiniCPM5 - 1B,主打低成本部署等。它由AI编写的ForgeTrain框架参与预训练,效果与英伟达Megatron对齐且速度快10%。该模型在榜单表现优,应用边界广,部署门槛低。

机器之心
新闻资讯8

梅花创投吴世春:AI不再卖工具,而是卖收益|甲子引力X

在「渡口——甲子引力X2025科技产业投资大会」上,梅花创投吴世春剖析AI创业投资逻辑。他认为大模型格局已定,资本兴奋点转向应用,AI价值锚点从技术转向商业结果,AI将成基础设施。

甲子光年
推荐文章7

深刻理解Token:大语言模型(LLM)是如何看待这世界?

文章指出在大语言模型(LLM)中,Token是处理文本的基本单位。介绍了Token的概念、分词方法、向量化过程,还阐述了分词对模型性能的影响,如导致模型在数学、多语言处理上表现不佳等。

AINLPer
开源动态8

耶鲁等团队联合发布首个虚拟细胞Agent,可自动设计出先进的模型

耶鲁等团队发布首个多智能体系统CellForge,可自动化设计虚拟细胞模型。它能输出模型架构和代码,有跨模态能力,性能超多个领域代表性模型,可降低科研门槛,加速药物研发。

力学与人工智能
新闻资讯7

OpenAI推理第一人创业了:要造“活到老学到老”的AI,先来融它70个亿

OpenAI推理模型第一人Jerry Tworek离职不到一个月就创业,新公司Core Automation计划筹集10亿美元,要做具备「持续学习」能力的新型AI模型,解决主流模型‘训完就上线’、能力固定的问题。

量子位
新闻资讯7

807道灵魂拷问后,中国模型竟在「意义测试」中夺冠!

在美国新基准测试FAI - C中,中国开源模型Qwen3夺冠,DeepSeek的R1跻身前六,力压美国明星实验室顶级模型。该测试由前英特尔CEO帕特·基辛格所在公司Gloo推出,旨在让AI直面深层问题。

新智元
算法论文8

精准调控大模型生成与推理!浙大&腾讯新方法尝试为其注入“行为定向剂”

ACL 2025中选论文里,浙大与腾讯联合团队提出STA方法,深入模型内部分析神经元激活模式,干预关键神经元,抑制有害行为、保留通用性能,还在多模型实验验证效果,并将部分方法开源。

量子位