模型使用」共找到 8599 篇相关文章

算法论文8

从「记忆解题」到「深度推理」:港科大推出首个本科数学动态评测基准 UGMathBench

港科大团队发表在 ICLR 2025 的研究 UGMathBench,是首个本科数学动态评测体系。它涵盖 16 个学科领域,通过变量扰动创建多版本试题,引入创新指标评估模型推理能力,测试结果揭示了当前模型短板。

AI科技大本营
推荐文章8

大佬深度解析:Coding Agent的底层运行逻辑是什么?

本文由AI领域知名学者Sebastian Raschka撰写,探讨编码智能体及其编排的设计、工作原理和组件协同。指出智能体周边支撑系统重要性不亚于模型本身,详细阐述编码智能体六大核心构建模块。

机器之心
算法论文8

VLM剪枝新SOTA:无需重训练,注意力去偏置超越6大主流方案

常用的attention机制存在位置偏置和padding异常,影响剪枝效果。上海大学曾丹团队提出无需重新训练的attention去偏方法,在多模型、剪枝策略及基准上验证有效,为多模态模型部署提供新思路。

新智元
新闻资讯7

Mistral AI正完成20亿欧元融资,估值140亿美元

彭博消息,法国大模型平台Mistral AI正完成20亿欧元投资,估值达140亿美元,或成欧洲最有价值科技初创公司之一。该公司此前已获超10亿欧元融资,发展迅速,推出多款模型

AIGC开放社区
新闻资讯7

The Batch: 839 | 好莱坞加入 AI 版权之争

好莱坞电影公司加入对用其版权作品训练AI模型公司的抗争。迪士尼和环球起诉Midjourney,指控其未经授权用版权作品训练模型、分发含其角色图像,请求停侵权并索赔,版权法相关界定尚不明确。

DeeplearningAI
算法论文8

AI4S回归白盒符号主义,清华等联合发布SR-LLM:自主发现科学知识

清华大学等多所高校联合发布SR - LLM,这是融合大语言模型与深度强化学习的符号回归框架。它从数据生成可解释数学模型,在跟车行为建模等任务表现优,为机器自主科学发现开辟新路径。

新智元
推荐文章7

2025 年的 Vibe Coding 思考|Reflections on Vibe Coding in 2025

作者基于自身经历和观察分享 2025 年 Vibe Coding 思考。指出创作应从喜好和用户需求出发,与用户紧密相连,还对 2026 年模型发展、产品方向等做了预判,探讨了实现人人 Vibe 还缺的条件。

InfoQ
产品应用8

ZeroGPU Spaces 加速实践:PyTorch 提前编译全解析

本文聚焦 ZeroGPU Spaces 加速实践,介绍 PyTorch 提前编译。ZeroGPU 使在 Hugging Face Spaces 用 Nvidia H200 硬件更高效,但有局限。提前编译可优化模型,提升演示速度,还分享了接入方法、高级技巧及演示示例。

Hugging Face
产品应用8

150PB工业数据+智能体革命,西门子开启AI制造新纪元

西门子在工业AI领域成果显著。其工业智能体系统贯穿工业脉络,Industrial Copilot提升开发效率。工业基础模型扎根150PB工业数据,与主流大模型路径不同。西门子靠数据和行业know - how构筑护城河。

机器之心
算法论文8

40倍推理加速!复旦&微软:用「非线性流」拟合复杂轨迹,2步生成媲美原画

ArcFlow是复旦与微软提出的图像生成加速方案,引入非线性流拟合复杂轨迹。它在仅2步推理下保持画质,实现约40倍推理加速和4倍训练收敛加速,微调极少参数,在多模型验证效果出色。

量子位