智源大会」共找到 5916 篇相关文章

算法论文8

工行x上交发布多智能体研究成果,通过群体智能刷新翻译新高度!

2025年多智能体系统成模型研发新高地。工行数据和人工智能实验室与上海交人工智能学院推出多智能体翻译系统TACTIC,以认知翻译学为指导,在相同模型配置下提升翻译效果,在小模型下提升更明显。

深度学习自然语言处理
新闻资讯7

ICML 2026新规「避坑」指南:参非必须、原稿将公开、互审设上限

要投 ICML 2026 顶的需注意新规,如论文被接收作者可选择是否参,原始投稿版本将公开,互审论文数量受限等。还介绍了投稿要求、重要日期、评审机制等内容。

机器之心
新闻资讯8

前OpenAI灵魂人物Jason Wei最新演讲!三思路揭示2025年AI终极走向

前OpenAI核心研究员Jason Wei在斯坦福演讲,提出AI发展三思路。他认为智能商品化、成本下降,自适应算力出现;所有能被验证的任务最终被AI解决;AI智能呈锯齿状,不瞬间超越人类。

新智元
产品应用8

昇腾+鲲鹏联手上招!华为爆改MoE训练,吞吐再飙升20%,内存省70%

最近华为在MoE训练系统给出算子和内存优化新方案,三核心算子全面提速,系统吞吐再提20%,Selective R/S实现内存节省70%,为规模MoE模型训练扫清障碍。

新智元
新闻资讯7

小米小爱同学:资源受限下,实现端侧模型的高性能推理

InfoQ对话小米小爱同学端侧AI负责人杨永杰,了解其团队在资源受限的端侧设备实现模型高性能推理的策略。目前端侧模型商业化落地慢,团队提前布局,自研框架,实现超180 tokens/s推理速度,还分享未来突破方向。

InfoQ
产品应用8

模型虽好,但恕我直言:在OCR面前,开源小模型更香

作者所在公司项目需处理量纸质文档,起初考虑云端模型API调用和开源模型本地化部署,却因成本高、硬件要求高受阻。后经推荐调研PaddleOCR,其功能全、成本低、易用性强,最终被选为项目核心方案。

PaperAgent
算法论文8

清华&通院推出"绝对零"训练法,零外部数据模型自我博弈解锁推理能力

清华、北通院和宾州州立学研究人员提出“绝对零”训练法,让模型通过自我博弈生成并解决任务获推理能力。测试显示,其训练出的模型超专家标注样本训练的模型,且能提升编程与数学推理表现。

量子位
开源动态8

让图像生成告别 AI 味!清华 + 港中 + 腾讯混元联手推出SRPO

腾讯混元联合港中、清华推出SRPO,解决文生图技术痛点。它结合Direct - Align和SRPO,提升图像审美等,训练时间缩至十分钟,在测试中碾压主流方法,不过对冷门风格控制和机制可解释性待提升。

AIGC开放社区
推荐文章7

语言模型(LLM)到底是怎么运作的?(配图通俗讲解)

文章先介绍条件概率,指出语言模型预测下一个单词是条件概率问题,计算所有可能单词的条件概率选最高的。还提到直接选最高概率使内容单调,引出温度概念,它能调整概率分布影响抽样结果。

宝玉AI
算法论文8

ICML 2025 Spotlight | 多模态模型暴露短板?EMMA基准深度揭秘多模态推理能力

最新研究推出 EMMA 基准测试,揭示顶尖多模态语言模型在深度视觉与文本融合的复杂多模态推理上显著不足。该研究已被 ICML 2025 接收,代码数据开源。实验表明,现有模型与人类专家差距,视觉推理是核心瓶颈。

机器之心