在离线混部」共找到 8196 篇相关文章

新闻资讯8

ICML 2026前瞻:投稿翻倍背后,机器学习正换挡

第43届国际机器学习大会(ICML 2026)7月6 - 11日将韩国首尔举行,主题为‘Machine Learning for the Real World’。今年投稿量翻倍,接收率26.6%,还做了两项制度调整。论文反映出LLM推理、AI安全、模型压缩等趋势,中国研究者表现亮眼。

AI科技评论
产品应用7

智能体时代EDA工具革新,比昂芯科技专注AI驱动电路仿真及Chiplets设计

近期,AI+芯片设计生成成全球资本热门赛道。比昂芯科技早2024年就启动AIEDA领域的底层技术探索,形成AI原生EDA完整技术闭环。其研发总监吴晨博士IDAS 2026分享实践,公司还有四大核心产品及服务。

芯师爷
开源动态8

告别大模型“失忆”!人大开源MemSifter:轻量代理先思考再回忆,搞定长时记忆

当前大语言模型长周期任务中,长时持久记忆管理陷入“精度不够”和“成本太高”的两难困境。中国人民大学团队提出MemSifter框架,将记忆检索工作外包给轻量级代理模型,8个权威测试中超越现有方案,且已开源。

PaperAgent
算法论文8

Codeforces难题不够刷?谢赛宁等造了个AI出题机,能生成原创编程题

LiveCodeBench Pro团队推出AutoCode框架,利用LLM自动化竞赛编程问题创建与评估。该框架结合验证器 - 生成器 - 检查器框架与双重验证协议,测试用例生成上可靠性佳,还能生成新问题,同时揭示了LLM创作上的优劣势。

机器之心
开源动态8

阿里智能体多轮推理超越GPT-4o,开源模型也能做Deep Research

通义实验室推出自主信息检索智能体WebDancer,其通过系统化训练范式为构建智能体提供路径,也为开源模型上复现Deep Research系统提供指导。它多数据集测试中表现出色,团队还对其未来应用做了展望。

量子位
算法论文8

10行代码,AIME24/25提高15%!揭秘大模型强化学习熵机制

来自多机构的研究者揭示大模型强化学习中熵变化机制。发现策略熵训练中急剧下降致性能停滞,提出 Clip - Cov 与 KL - Cov 两种正则化技术调控高协方差标记,遏制熵塌缩,部分数据集上性能提升显著。

机器之心
算法论文8

CVPR 2026 | 20步也能稳住画质,这个扩散加速方法不一样

扩散模型推理效率是落地应用的核心制约因素,阿里安全 AGI 实验室 - 御风大模型团队联合浙江大学提出全新扩散加速方法 TC - Padé,低步数设置下能兼顾生成质量与推理效率,已被 CVPR 2026 录用。

机器之心
开源动态8

社区供稿丨Ring-2.5-1T,思更深,行更远

今天发布并开源万亿参数思考模型 Ring-2.5-1T,生成效率、思考深度、长程执行上大幅提升。与其他模型对比,高难推理和长程任务执行达开源领先。介绍架构优势、手搓案例,也提及不足与未来计划。

Hugging Face
算法论文8

超94%类别第一!3D点云异常检测与修复新SOTA | ICCV'25

3D点云异常检测制造等领域重要,但传统方法有丢细节、难修复问题。上海科大与密歇根大学团队提出PASDF框架,借助相关技术达成检测修复一体化,实验显示精准稳定,两大基准上成绩优异。

新智元
开源动态8

抖音&LV-NUS开源多模态新模,以小博大刷新SOTA,8B推理比肩GPT-4o

抖音SAIL团队与LV - NUS Lab联合推出多模态大模型SAIL - VL2,以中小参数规模106个数据集实现性能突破。该模型从架构、数据、训练三方面创新,后经全链路优化,多数据集验证中表现卓越。

量子位