文心大模型4.5」共找到 8858 篇相关文章

算法论文7

CodeClash 通过多轮编程竞赛对大型语言模型进行基准测试

为评估大型语言模型(LLM)编码能力,斯坦福、普林斯顿和康奈尔研究人员开发 CodeClash 基准测试,让多个 LLM 在多轮比赛中较量,涉及多种代码竞技场,还评估模型分析代码库能力,未来将处理更大代码库。

InfoQ
新闻资讯7

英伟达叫板DeepSeek?怒投260亿美元,要打造最强开源模型

英伟达已成为人工智能时代基础设施的一部分,2023年11月推出首个Nemotron模型进入通用大模型领域。未来五年将投260亿美元构建开源模型,还发布了性能最强的开源模型Nemotron 3 Super。

机器之心
开源动态8

刚刚,梁文锋署名开源「记忆」模块,DeepSeek V4更细节了

十几个小时前,DeepSeek 发布新论文,与北大合作,作者有梁文锋。针对大模型问题提出条件记忆,用 Engram 模块实现,已开源。结合此前研究,DeepSeek v4 模样渐清。模型性能、效率表现优,并发现 U 型扩展规律。

机器之心
新闻资讯7

内部爆料:Alexandr Wang上任第一把火,Meta大模型闭源

据知情人士,Meta新成立的超级智能实验室正讨论重大决策,高层对AI模型是否开源存分歧。Meta曾因性能问题延迟Llama 4版本,现完成Behemoth训练却因不佳延迟发布,还探讨放弃它开发闭源模型

机器之心
算法论文8

多模态推理新范式!DiffThinker:用扩散模型「画」出推理和答案

上海人工智能实验室等团队提出全新生成式多模态推理范式,发布模型 DiffThinker。它打破传统定式,以图像到图像生成任务重构推理过程,在多项复杂任务中表现优于顶尖闭源模型,有四大核心特性。

机器之心
新闻资讯8

Fable 5夺冠!全球18大顶尖AI自主科研大赛,逼近人类极限

Prime Intellect公开大规模AI自主科研实验,18大顶尖模型断网8天挑战nanoGPT优化器速通,Fable 5追平人类82%的水平,AI开始独立完成科研闭环,但目前尚无模型有全新方法。

新智元
新闻资讯8

今夜无显卡!老黄引爆Rubin时代,6颗芯狂飙5倍算力

CES 2026上,英伟达黄仁勋发布Vera Rubin超算架构,推理性能比Blackwell提升5倍,训练性能提升3.5倍,成本降10倍,已投产,下半年商用。还展示自动驾驶模型等,且无新显卡发布。

新智元
产品应用8

编程能力开源SOTA,网络安全提升2倍!智谱发布GLM-5.3

智谱发布GLM-5.3,743B参数模型,编程能力达开源SOTA。网络安全能力涌现,基准得分是GLM-5.2两倍多。全部提升来自后训练缩放,还自研Z.ai Code Bench评估,安全评估加固后权重将开源。

AIGC开放社区
新闻资讯8

刚刚,智谱港交所敲钟!市值528亿港元

智谱在港交所敲钟上市,成全球首家AGI基座模型上市公司,首日市值超528亿港元。其IPO受热捧,资本阵容强大。新一代模型GLM - 4.7表现出色,营收增长快,大部分资金用于研发,标志中国大模型迈向全球竞技。

量子位
产品应用8

Kimi新出的Agent集群,到底有多恐怖?

Kimi发布K2.5模型及Agent集群功能,将国产AI推向“组织智能”新高度。K2.5全能且开源,多项评测优于GPT - 5.2 - xhigh且成本低。Agent集群可按需协调子Agent,实现“角色涌现”与“3D编排”。

newtype AI