智源大会」共找到 5916 篇相关文章

产品应用7

AIGCode宿文:我就是要自训练模型,直接做「L5」| AI产品十人谈

AIGCode宿文坚信Coding是培育模型的最佳场景,公司自训练66B基础模型,发布锡月模型,开启AutoCoder内测。宿文认为AI Coding能解决代码供给问题,目标是实现AGI,虽面临诸多质疑,但他坚持直接做L5。

AI科技评论
开源动态7

20人团队提前实现DeepSeek构想,AI算力变天?直击模型算力成本痛点

国内20人玉盘AI团队推出SRDA全新计算架构方案,试图从硬件源头解决当前AI算力核心瓶颈。该架构有诸多创新设计,能应对模型训推痛点,与DeepSeek构想契合,或成模型专用架构分水岭。

新智元
新闻资讯7

模型私有化火了:百万一台的一体机卖疯,最赚钱的一层却没人愿干

文章指出模型私有化部署虽因合规、开源模型及国产算力发展而兴起,但利润结构呈哑铃状。算力层规模但毛利低,模型层因开源难盈利,交付层最赚钱却因项目制难规模化,国际市场也类似。

AI Reading Hub
产品应用8

SDD-RIPER 团队落地指南:如何让整个团队在一周内跑通模型编程

文章提供了 SDD - RIPER 团队落地方案,能让团队一周内跑通模型编程,质量可控、效果可量化。阐述了推不动模型编程的痛点及 SDD - RIPER 的解决办法,介绍了部署、实操流程和试点 SOP,还给出效果数据与常见问题解答。

阿里云开发者
算法论文7

苹果港终结自回归时代?7B扩散模型发布,AI写代码逻辑彻底颠覆!

苹果联合港开源扩散语言模型DiffuCoder,用扩散模型+强化学习策略,性能提升4.4%。研究还提出耦合梯度奖励策略优化方法,建立原生RL训练框架,探究了dLLM的生成机制等问题。

新智元
产品应用8

中国电信天翼AI发布首款AI眼镜,星辰模型开启第一视角智能交互新时代

在2025世界人工智能上,中国电信天翼AI发布全球首款融合自研“星辰模型”的智能穿戴设备——天翼AI智能眼镜,依托云网融合与星辰模型,开创第一视角智能交互新范式。

AI科技评论
产品应用8

三星研究院发布手机端侧模型MeKi:基于Memory的LLM扩展新范式,支持旗舰手机端侧部署

三星研究院发布端侧模型架构MeKi,提出用存储空间扩展模型容量、提升LLM性能的新范式。它利用手机ROM缓解内存压力,实现容量与性能提升。实验显示其性能、效率表现优,为边缘部署LLM提供新思路。

AI科技评论
算法论文8

复旦、同济和港中文等重磅发布:强化学习在语言模型全周期的全面综述

来自多所顶尖科研机构的研究者完成长文综述,总结语言模型全生命周期的强化学习研究,阐述其各阶段应用策略,分析未来挑战与趋势,重点关注 RLVR 技术,有全生命周期梳理等三贡献。

机器之心
开源动态8

探针伸进模型黑箱,南加州学华人团队打造AI记忆研究的深空望远镜

南加州学 Robin Jia 教授团队借助英伟达算力,构建基于 Llama 3 架构的全开源受控模型 Hubble,其成果将在 ICLR 2026 亮相。研究揭示模型记忆机制效应,还评估了‘机器遗忘’技术,有法律应用潜力。

DeepTech深科技
算法论文8

字节&MAP重塑模型推理算法优化重点,强化学习重在高效探索助力LLM提升上限

强化学习虽提升语言模型表现,但面临探索难题。字节跳动等团队提出FR3E框架,分两阶段重建探索机制,在多数学推理基准实验中显著优于强基线,为模型强化学习提供新范式。

量子位