能力提升」共找到 5147 篇相关文章

算法论文8

腾讯混元 x MBZUAI 港中文新研究:将纠错纳入策略空间,Search-R2 重构搜索增强推理学习方式

过去大语言模型能力提升靠参数和数据扩张,但在真实任务中此路径有局限。腾讯混元、MBZUAI、港中文联合团队提出Search - R2,将纠错纳入策略空间,抑制错误传播,在多跳推理任务中优势显著。

AI科技评论
算法论文8

AST | 西工大崔榕峰、张伟伟等:基于物理约束与双并行注意力UNet++的高保真度三维机翼流场重构研究

本文针对三维机翼流场重构难题,提出DPAtt - UNet++框架,融合几何隐式编码、多尺度注意力与物理规律约束。实验表明,其重构精度高,预测速度较CFD提升2 - 3个数量级,为飞行器气动分析提供新路径。

力学与人工智能
产品应用8

Lovart第一时间上线Image 2:每个人真的可以瞬间拥有一个设计部了

Lovart上线Image 2,有去AI味的写实感、强大文字生成与泛化推理能力,完爆Nano Banana 2。它结合独家工作流,带来设计体验飞升,还给出五个使用场景案例,并对比了与Claude design的差异。

AI寒武纪
产品应用8

PolarDB AI助手:自然语言驱动的智能数据库运维新范式

企业数据库运维复杂度高,专业人才稀缺成瓶颈。阿里云PolarDB推出AI助手,基于大语言模型与专家知识库,有智能问答等核心能力,以自然语言交互降低使用门槛,提升运维效率与系统稳定性。

阿里云开发者
新闻资讯7

2025年了,AI还看不懂时钟!90%人都能答对,顶尖AI全军覆没

AI基准ClockBench测试AI读模拟时钟能力,人类平均准确率89.1%,11个主流大模型最好仅13.3%。研究展示了LLM局限性,分析了可能原因,还对比了不同模型表现及在各类问题上的差异。

新智元
算法论文8

全新GPU高速互联设计,为大模型训练降本增效!北大/阶跃/曦智提出新一代高带宽域架构

随着大模型参数规模扩大,分布式训练成关键路径,高带宽域设计对提升训练效率至关重要。现有HBD架构在可扩展性、成本和容错能力等方面有局限,北大、阶跃、曦智团队提出InfiniteHBD架构解决问题。

量子位
开源动态8

全能高手&科学明星,上海AI实验室开源发布『书生』科学多模态大模型Intern-S1 | WAIC 2025

7月26日,上海AI实验室在WAIC 2025上发布并开源『书生』科学多模态大模型Intern-S1。它首创‘跨模态科学解析引擎’,在多学科专业任务上超越顶尖闭源模型,多模态综合能力领先主流开源模型。

OpenMMLab
新闻资讯8

更会聊天、主打情绪价值,OpenAI 发布 GPT-5.1

今天凌晨,ChatGPT 模型升级为 GPT-5.1,官方主打更智能、更具对话性。它有 GPT-5.1 Instant 和 GPT-5.1 Thinking 两个子模型,本周内逐步向所有用户免费开放。升级重点在模型能力和个性化设置。

Founder Park
算法论文8

大模型再爆弱点!旧记忆忘不掉,新记忆分不出,准确率暴降 | ICML'25

弗吉尼亚大学和纽约大学研究人员用「前摄干扰」概念设计测验PI - LLM,测试大语言模型(LLM)上下文检索能力。结果显示,随干扰增加,模型准确率对数下降至零,提示工程效果有限,需调整模型架构或训练范式。

新智元
开源动态8

一张4090就能爆改!面壁智能MiniCPM-V 4.6开源,1B多模态卷出新高度

今年是AI应用大规模落地年,参数小的端侧模型有特定场景性能优势。5月11日面壁智能开源MiniCPM-V 4.6,参数仅约1B,多模态能力超阿里、谷歌同类模型,还在多维度提升,站稳端侧多模态开源领域。

机器之心