云栖大会」共找到 5916 篇相关文章

推荐文章7

独立自主梦太多,是国产化的最阻碍

我国虽建立完整工业体系,但 IT 领域差距。国产基础组件百花齐放,给上层应用适配带来灾难。美国在基础能力上近乎垄断,投入保持领先。国内小投入难出好产品,应整合市场。

AI与安全
开源动态8

击败 GPT-5!理想汽车开源 RubricHub:模型开放生成从此有了专业裁判

理想汽车基座模型团队联合高校发布RubricHub数据集,解决开放式任务评价难题。该数据集可将主观评价转化为量化标准,经其训练的Qwen3 - 14B小模型在医疗基准测试中超越GPT - 5。

AI科技评论
新闻资讯7

Claude Opus 4.1代码实测惊人!OpenAI开源模型却只写屎山?

昨日,OpenAI、谷歌和Anthropic等发布新模型。Anthropic推出Claude Opus 4.1,虽性能提升不,但编码能力获客户认可。实测显示Claude - Opus - 4.1写代码稳,OpenAI新模型表现不佳。

新智元
新闻资讯7

Agent 元年已至,我们拥有自己的智能助理吗?|GAIR Live 预告

2024年被认为是「Agent元年」,智能体浪潮正改写工作与生活。6月14日上午10点,GAIR Live线上圆桌论坛将围绕「Agent」话题展开,5位一线嘉宾探讨其发展阶段、应用方向等关键议题。

AI科技评论
算法论文8

ACL'25 | CIGEval:一种基于多模态模型的可控生图评测智能体

阿里国际AI团队提出CIGEval,这是基于多模态模型驱动的图像生成评估智能体框架。它集成多功能工具箱,通过任务拆解与工具调度提升评估准确性与可解释性,已在ComfyUI - Copilot上线。

PaperAgent
算法论文8

ICML 2025 | 注意力机制中的极值:破解语言模型上下文理解的关键

ICML 2025新研究揭示,在使用RoPE的现代Transformer模型里,注意力机制Q和K表示有集中极值,V表示无此模式。研究通过实验明确极值与上下文知识理解的联系,对模型设计、优化和量化有重要启示。

深度学习自然语言处理
算法论文8

ICML 2025 | 注意力机制中的极值:破解语言模型上下文理解的关键

ICML 2025新研究揭示,在使用旋转位置编码 (RoPE) 的现代Transformer模型中,注意力机制的查询 (Q) 和键 (K) 表示存在集中极值,而值 (V) 表示无此模式。研究通过实验揭示其与上下文知识理解的关键联系。

机器之心
算法论文8

ACL 2026 | 中科&上海AILab揭示强化学习后训练的Scaling Law

中国科学技术学和上海人工智能实验室等团队,在Qwen2.5和Llama 3模型开展研究,揭示强化学习后训练的Scaling Law,提出幂律公式预测模型学习效率与训练轨迹,成果被ACL 2026接收。

机器之心
算法论文8

AST | 西工马龙、邬晓敬等:几何特征知识驱动的代理优化方法

机器学习为气动外形设计提供新方法,但高效挖掘利用几何与气动数据知识是难题。本文提出气动监督自编码器架构,利用小样本气动数据监督学习几何特征,嵌入优化框架提升样本质量及优化效率,经翼型和机翼验证有效。

力学与人工智能
新闻资讯7

The Batch: 871 | Mistral测量了语言模型的能耗、水耗与物料消耗

法国AI公司Mistral发布对Mistral Large 2的环境分析报告,涵盖全生命周期影响。研究表明单次使用影响小,但累计负担。虽研究有不足,但其方法或推动环保型AI发展。

DeeplearningAI