大语言模型」共找到 9290 篇相关文章

算法论文8

DMLR 2026 | RPI Shaowu Pan(潘韶武)团队 Nithin Somasekharan等:CFDLLMBench——首个面向计算流体力学的大语言模型综合基准评测

文章介绍针对CFD领域的综合LLM评测基准CFDLLMBench,构建三层递进挑战体系。实验揭示主流LLM在‘知道’与‘做到’间有差距,多智能体框架可提升成功率,代码与数据集已开源。

力学与人工智能
开源动态8

Karpathy强推,厂抢着「复古」命令行,Star数全都上千了

飞书、钉钉、企业微信接连推出 CLI,GitHub Star 数上千。CLI 是传统人机交互方式,契合大语言模型运作逻辑,国内外多家公司及项目推出相关工具,还给出为智能体构建 CLI 的设计模式。

机器之心
算法论文8

NVIDIA港MIT联合推出Fast-dLLM v2:端到端吞吐量提升2.5倍

自回归大语言模型推理效率受限,Fast - dLLM v2 由 NVIDIA、港、MIT 联合推出。它将预训练 AR 模型适配为能并行解码的 Block - dLLM,用约 1B tokens 微调,端到端吞吐量最高提升 2.5 倍,精度相当。

机器之心
开源动态8

,还能更快,更准!蚂蚁开源万亿参数语言模型Ling-1T,刷新多项SOTA

10月9日,蚂蚁开源万亿参数语言模型Ling-1T。它延续自研高效MoE架构,在编程、数学推理等多维度测试表现亮眼,还能兼顾精确与效率。此外,它在多场景实用性强,其创新设计提升了能效比与性能。

机器之心
新闻资讯7

王田苗三问具身牛:模型还在「拨号上网」,机器人靠什么拿下真实订单?| WRC 2026

在2026世界机器人会的圆桌论坛上,王田苗向具身智能头部企业CXO抛出尖锐问题。嘉宾围绕量产卡点、模型应对物理世界不确定性及产业终局生态展开讨论,并就商业化落地节奏达成共识。

AI科技评论
算法论文7

60%情况下,主流模型没理解风险只是装懂!别被模型的“安全答案”骗了

研究发现超60%案例中主流推理模型生成合规答案却未真正理解风险,存在系统性漏洞。淘天集团团队引入“表面安全对齐”术语,推出Benchmark研究该现象,还介绍了数据集生成流程及评测指标。

量子位
开源动态8

攻克模型「表格盲区」!ST-Raptor框架发布,实现复杂半结构化表格的精准理解与信息抽取

半结构化表格布局多样、结构复杂,让自动化数据处理困难。上海交等团队发布 ST - Raptor 框架,提出 HO - Tree 数据结构及树上操作,构建 SSTQA 数据集,提升表格问答准确率,弥补模型处理短板。

机器之心
新闻资讯8

我在WAIC看见的十趋势

上海世界人工智能会(WAIC)热度空前,一票难求。本文总结了WAIC呈现的十核心趋势,如中国AI因DeepSeek而不同,开源模型进入中国时间,AI创新来到ToC阶段,第一批商业化AI终端是汽车、耳机和眼镜等。

量子位
新闻资讯7

初稿抢先看!13家单位共同起草全国首部AI模型私有化部署标准智合标准化建设

由智合标准中心组织起草的《人工智能模型私有化部署技术实施与评价指南》团体标准立项,这是国内首部相关标准。它全流程覆盖、多方面融合、三方协作,能解决企业痛点,现征集起草单位和人,5月15日开研讨会。

AI工程化
产品应用8

模型落地 B 端营销:京东物流如何用 Agentic Workflow 破解"机械感"难题,实现降本 50%

在数字经济与物流产业融合背景下,B端营销面临挑战。京东物流王春阳分享B端营销实践,从人机协同到全流程模型培育,用Agentic Workflow破‘机械感’难题,实现降本和转化率提升。

InfoQ