高质量专注」共找到 2419 篇相关文章

开源动态8

刚刚,大模型装上「鹰眼」!首创刷视频理解,谷歌Gemini 2.5完败

面壁智能开源MiniCPM-V 4.5多模态端侧模型,8B参数越级反超72B巨无霸,在多领域达SOTA。它首创刷视频理解,性能强、效率、适合端侧部署,还实现多技术创新,是开源端侧多模态AI的革命。

新智元
新闻资讯7

「机械飞升」18个月后,马斯克首位脑机植入者重磅发声:我重生了!

Neuralink首位脑机芯片植入者Noland Arbaugh术后18个月称像重生,能用思想玩游戏、控家电。Neuralink设备有连接率、无线等优势,后续将开展盲人视力恢复试验,不过其方法也受批评。

新智元
开源动态7

LangChain 推出开源异步编码智能体 Open SWE

LangChain发布开源异步编码智能体Open SWE,可在云端处理复杂开发任务,能集成到开发者工作流。它连接GitHub仓库,在沙箱运行,强调人在回路控制,多智能体架构保障代码质量,早期反应褒贬不一。

InfoQ
开源动态8

快手Klear-Reasoner登顶8B模型榜首,GPPO算法双效强化稳定性与探索能力!

快手Klear团队推出Klear-Reasoner模型,基于Qwen3 - 8B - Base打造,在多基准测试达同规模SOTA。其核心GPPO算法能强化稳定性与探索能力,团队还对训练流程多环节深入分析,给出优化策略。

AI前线
新闻资讯7

AI顶会反噬整个学术圈!「不发表就会死」,NeurIPS爆仓,博士年肝4.5篇大崩溃

NUS研究者指出,NeurIPS等AI顶会投稿量激增,正反噬学术圈。当前模式存在结构性危机,如学术产出泡沫化、环境代价、研究者心理负荷大等。为此,他们提出“社区联邦会议”(CFC)模型以解决问题。

新智元
算法论文8

监督学习未死,一题训练五小时起飞!华人学者新方法20倍训练效率释放大模型推理能力

大模型推理能力研究中,RL训练资源成本、不稳定,传统SFT低数据量易过拟合。加拿大滑铁卢大学华人团队提出One - Shot CFT方法,用一题多解多点评训练,仅需约5个GPU小时,效果好、稳定性强。

量子位
算法论文8

DeepSeek-GRPO重要性权重设计错误?详解Qwen3新强化学习算法GSPO

论文指出GRPO在大语言模型训练中不稳定,因其重要性权重设计错误易引入方差噪声。为此提出GSPO算法,从序列维度计算梯度,解决了MoE模型RL训练的稳定性问题,在Qwen3上效率更

深度学习自然语言处理
产品应用7

多模态“卷王”阶跃星辰:如何利用 JuiceFS 打造效经济的大模型存储平台

有“多模态卷王”之称的阶跃星辰,自研多模态模型,早期商业存储系统难满足需求,后引入 JuiceFS。文章介绍大模型各环节存储需求,详述 JuiceFS 企业版与社区版优化实践,含模型分发、读性能等优化。

InfoQ
8

DeepMind夺得IMO官方「唯一」金牌,却成为OpenAI大型社死现场

谷歌DeepMind宣布其Gemini进阶版模型在IMO竞赛达金牌水平,解决五道超难度试题,首次证明AI仅靠自然语言理解就能攻克复杂数学难题。其谨慎发布方式获赞誉,与OpenAI形成鲜明对比。

机器之心
算法论文7

手机上实现AI视频实时生成,DiT模型上移动端

扩散变换器在视频生成任务性能强,但计算成本,在手机上难实用。Snap提出创新优化法,加速视频生成,能在iPhone 16 Pro Max上每秒超10帧,不过也存在细节退化等局限。

带你学AI