推理能力」共找到 4620 篇相关文章

算法论文8

Embedding黑箱成为历史!这个新框架让模型“先解释,再学Embedding”

来自多高校研究人员推出可解释的生成式Embedding框架GRACE,解决传统文本表征模型黑箱式表征瓶颈。它重新定义对比学习信号,含三个关键模块,训练双模式统一,实验跨任务提升且不损生成能力

量子位
产品应用7

英伟达用NIM + NV-Tesseract模型,提高芯片生产良率

芯片制造良率控制难题待解,传统方法各有局限。英伟达推出NV - Tesseract模型家族和NIM推理微服务,二者结合用于半导体晶圆厂生产,可实时发现问题、预测故障,降低成本,为制造打开新大门。

AIGC开放社区
算法论文8

告别微调!斯坦福提出Agentic上下文工程

当前微调大语言模型成本高、不灵活,‘上下文适应’方法有短板。斯坦福大学等提出ACE框架,将上下文变为动态‘战术手册’,解决现有问题。论文通过实验验证其在性能、成本和效率上优势,为大模型发展指明新方向。

深度学习自然语言处理
新闻资讯8

Sora 2深夜来袭,OpenAI直接推出App,视频ChatGPT时刻到了

别家节前卷大模型时,OpenAI 悄悄发布 Sora2 并推出 App,还有配套视频推送算法防成瘾。Sora2 在物理准确性等方面优于以往系统,具备同步对话和音效能力,Altman 称是 ChatGPT for creativity 时刻。

机器之心
开源动态8

Agentic Coding表现创新高,全新KAT系列模型强势霸榜SWE-Bench

快手 Kwaipilot 团队推出 KAT 系列两款 Agentic Coding 大模型,KAT - Dev - 32B 开源,KAT - Coder 闭源。两模型在 SWE - Bench Verified 表现出色,且在多训练阶段创新优化,有强大代码生成能力和涌现现象。

机器之心
产品应用8

阿里Qwen3一大波更新:代码生成、视频、图片、语音全都有

阿里Qwen3迎来一大波更新,涵盖多个模型。如Qwen3-Max在代码与智能体表现卓越;Qwen3-VL是强大视觉语言模型;Qwen3-Omni是全模态模型;还有图像编辑、同传、安全防护等模型及旅行规划师等应用。

AIGC开放社区
推荐文章8

配置驱动的动态Agent架构网络:实现高效编排、动态更新与智能治理

本文提出配置驱动的独立运行时 Agent 架构,解决低代码/平台化 Agent 方案企业级落地难题。介绍其核心架构、注册中心、配置定义等,还提及 Agent Studio、执行引擎等,阐述运行部署、协作、治理,提供通用可落地范式。

阿里云开发者
产品应用8

OpenAI 内部揭秘:我们如何使用 Codex

文章揭秘 OpenAI 内部使用 Codex 的情况,介绍其在理解代码、重构迁移、性能优化等多方面的应用场景,还给出最佳实践,如用‘提问模式’开始、组织好提示等,展现了 Codex 强大的开发辅助能力

宝玉AI
算法论文8

具身VLA后训练:TeleAI提出潜空间引导的VLA跨本体泛化方法

现有VLA基座模型能力不足,跨本体适配存在挑战。中国电信人工智能研究院具身智能团队提出“对齐 - 引导 - 泛化”(ATE)框架,实现从调架构到调分布的范式转移,适配主流VLA模型,减少数据需求。

机器之心
算法论文8

空间智能新高度:港科大谭平团队SAIL-Recon突破万帧级图像大规模3D场景重建Transformer

香港科技大学谭平教授团队与地平线团队发布3D场景表征与大规模重建新方法SAIL - Recon,突破现有模型处理能力瓶颈,可实现万帧级场景表征抽取与定位重建,在多数据集上表现优于现有方法。

机器之心