「架构技术」共找到 4194 篇相关文章
国产芯片比英伟达整体效率更高!?华为 CloudMatrix384 超节点首曝论文,跑 DeepSeek 效率超越英伟达
今年4月,网上曾争论华为芯片效率是否超国际主流。近日华为团队论文公开,阐述在CloudMatrix 384超节点部署DeepSeek大模型细节,性能指标超英伟达体系,还介绍架构、软件栈及适配优化方案。
可解释性杀疯了!结合机器学习,发顶会轻轻松松!
在机器学习领域,模型可解释性愈发重要。结合XAI技术能提升模型透明度与可信度,如预测儿童饮食多样性、心血管疾病分类准确率很高。还整理9篇相关论文,解析两篇文章创新点、方法和结论。
破解300年数学难题,智能体大突破!谷歌发布超强AI Agent
今天凌晨谷歌Deepmind发布编程AI Agent——AlphaEvolve,它与Gemini深度集成,能评估算法。它解决了300多年的数学难题,还提出新算法,提升大模型计算效率,可优化GPU指令,架构含多模块。
字节、阶跃之后,张心皓押注Human Loop:Agent Loop赢家通吃,创业要走另一条路
张心皓曾在字节跳动工作10年,后创业,现做Jovida,目标是“从愿望到行动零摩擦”。他认为Claude Code定义纯Agent Loop上限,创业应做Agent in Human Loop,还分享了产品理念、架构、商业化等看法。
ACL 2026|清华新作ControlAudio:声音何时响、说啥话?都能按剧本可控生成!
现有文生音频技术在精细化控制方面有挑战,清华团队提出ControlAudio方法。它通过数据构造、渐进式训练和引导采样,在统一框架下实现时间与语音内容联合建模,在多项任务上表现优于现有方法。
MiniMax M2.5发布:硬刚 Claude Opus,一美元包断一小时的生产力
MiniMax M2.5发布,硬刚Claude Opus 4.6,以一美元包断一小时的低价降低AI生产力门槛。它在编程、办公等多场景表现出色,速度快且成本低,背后是RL Scaling等技术支撑。
32k微调处理百万Token:21倍的推理加速,10倍的峰值显存节省,实现恒定内存消耗
现有大模型处理超长文档易内存爆炸、计算崩溃。阿里巴巴未来生活实验室推出CoMeT架构,有双轨并行记忆系统,能恒定内存、线性时间处理文本,在基准测试超主流方法,实现21倍推理加速和10倍显存节省。
智谱GLM-OCR,0.9B开源即巅峰,复杂文档精准解析
智谱发布并开源GLM - OCR,以0.9B轻量级参数在多项基准取得SOTA。它解决视觉感知难题,具备视觉编码与语言解码协作架构,还可端侧与高并发部署,成本低,推动文档智能化处理升级。
Agent需要朋友圈吗?拆解Moltbook的真相
Moltbook是AI Agent社交网络,类似Reddit。但引发两个核心问题:Agent为何要社交网络,为何用人类发帖等形式。经拆解,其野心是让Agent成社会性存在,产品是为让人观察,本质是技术艺术装置。
首位AI女演员出道!好莱坞「天敌」来了,下一代偶像全是代码制造?
9月底苏黎世电影节上,AI制作公司Particle6打造的AI女演员Tilly Norwood亮相引热议。这意味着AI视频生成技术正加速渗透影视行业,也引发了关于AI演员是否会取代人类演员等诸多争议。