「超并行实验」共找到 3431 篇相关文章
实测完豆包Seedream 4.5,替我设计师朋友哭了
火山引擎推出图像创作模型Doubao - Seedream - 4.5,有强化原图保持、多图组合生成、优化海报排版与Logo设计等主打点。经实测效果不错,已全量开放API并公测,官方还给出生图tips。
谷歌新架构突破Transformer超长上下文瓶颈!Hinton灵魂拷问:后悔Open吗?
谷歌在NeurIPS 2025发布两项大模型新架构研究,通过‘测试时训练’机制,推理阶段可将上下文窗口扩展至200万token。新成果Titans和MIRAS结合RNN速度与Transformer性能,突破超长上下文瓶颈。
停工停薪,百亿智驾独角兽停摆了
据红星资本局消息,2025年11月22日毫末智行发停工通知,自24日起员工停工放假,复工时间待定。该司曾是资本宠儿,如今账户冻结、工资停发。其衰落因技术掉队、商业化不顺等,凸显行业淘汰赛残酷。
25000 美元卖公司内部截图,丢了饭碗还要吃牢饭!大厂百万年薪抢招“内鬼分析师”,围剿下一个“自己人”
全球顶尖网络安全公司CrowdStrike遭“内鬼”泄密,黑客以25000美元收买员工获内部截图。如今全球大厂高薪抢招“内鬼分析师”,但构建内部威胁框架不易,需分层协作的安全与文化策略。
突破类脑模型性能瓶颈:校正频率偏置实现性能与能效双突破|NeurIPS 2025
香港科技大学(广州)等团队在NeurIPS 2025论文指出,脉冲神经网络(SNN)性能不佳根源是频率偏置,非二进制激活。团队提出Max - Former架构,校正频率偏置,实现性能与能效双突破,卷积架构也适用。
让AI评测AI:构建智能客服的自动化运营Agent体系
文章介绍智能客服发展,从传统机器人客服到基于AI原生的智能客服。重点探讨对话效果评测,搭建运营Agent平台,实现服务闭环。还提及评测落地方法、难题及解决措施,最后阐述AI在服务链路提效和分析转人工原因的作用。
小米打通智驾和具身大模型,然后开源了
小米汽车陈龙团队开源全球首个跨具身基座模型MiMo - Embodied,基于MiMo - VL架构,采用四阶段训练策略,打破室内操作与户外驾驶领域鸿沟,在29个Benchmark上超现有模型。
RAE+VAE? 预训练表征助力扩散模型Tokenizer,加速像素压缩到语义提取
近期,RAE 提出以「 冻结的预训练视觉表征」作潜空间提升扩散模型性能。同期西安交大与微软亚研院提出 VFM - VAE,结合 RAE 与 VAE,能加速模型收敛、提升生成质量,展示扩散模型 Tokenizer 演化方向。
强化学习 AI 系统的设计实现及未来发展
本文是阿里巴巴算法专家曹宇在 AICon 2025 北京站的分享,结合算法实践展示 RL 系统现状及发展脉络,探讨未来超大规模 RL 发展方向,涉及理论基础、业界实践、开源生态及社区共建。
具身智能一步踏入Scaling Law!10B+基础模型,27万小时真实数据
AI机器人创业公司Generalist推出新型具身基础模型GEN-0,参数量10B+,专为多模态训练构建。该模型展现强大Scaling Law,能力可扩展,有和谐推理等特性,在多方面有突破,成果备受赞誉。