后训练系统」共找到 5171 篇相关文章

新闻资讯8

透视Chiplet生态版图

随着摩尔定律逼近极限与AI算力需求爆发,集成电路产业从“单芯演进”迈向“系统集成”,Chiplet技术成关键。此报告剖析欧美政府项目战略及国际巨头的竞争态势,还探讨中国企业突围之路。

芯师爷
产品应用8

AgentScope x RocketMQ:打造企业级高可靠 A2A 智能体通信基座

文章介绍 Apache RocketMQ 新推的 LiteTopic 通信模型,能简化 AI 系统架构、提升稳定性。结合 A2A 协议与 AgentScope 框架案例,剖析智能体通信实践与技术实现,还给出构建多智能体应用的实战方案。

阿里云开发者
产品应用7

让AI真正懂数据:猫超Matra项目中的AI知识库建设之路

文章聚焦猫超Matra项目的AI知识库建设。猫超数据体系庞大但有治理难题,促使Matra项目诞生,旨在实现智能取数。文中详述知识库设计、实践及效果,还提及未来在准确性、保鲜性和能力拓展上的规划。

阿里云开发者
新闻资讯7

天孚通信市值1600亿,小镇青年如何逆袭江西宜春首富?

A股市场上,由新易盛、中际旭创、天孚通信组成的光模块“易中天”走红。天孚通信市值达1600亿,其创始人邹支农出身农村,带领公司造出国产陶瓷套管并上市。公司前瞻性布局契合AI算力需求,深度绑定英伟达,业绩增长显著。

芯师爷
算法论文8

NeurIPS 2025|指哪打哪,可控对抗样本生成器来了!

近日,清华大学和蚂蚁数科在NeurIPS上联合提出Dual - Flow新型对抗攻击生成框架。它能从海量图像数据学“通用扰动规律”,对多模型、多类别发起黑盒攻击,为AI安全带来挑战,已用于蚂蚁数科产品。

机器之心
算法论文8

模型大一统?1100多个模型殊途同归,指向一个「通用子空间」!

约翰斯・霍普金斯大学研究发现,1100多个不同神经网络,即便训练条件不同,最终权重会收敛到共享低维子空间。此研究为神经网络参数空间“通用性”提供严谨实证,虽成因待探索,但意义深远。

AINLPer
新闻资讯7

谷歌创始人布林:当年发完Transformer论文,我们太不当回事了

在斯坦福大学工程学院百年庆典活动上,谷歌联合创始人谢尔盖・布林与校长、工程学院院长对谈。他回顾谷歌发展,称曾对Transformer论文未足够重视,还分享对专业选择、大学模式、学术与产业等方面的看法。

机器之心
推荐文章7

「Memory as a Context」是否将重新定义 Transformer 的 「记忆模式」?

本期机器之心PRO会员通讯解读3个AI业内要事,包括「Memory as a Context」能否重新定义Transformer记忆模式、世界模型发展情况,以及OpenRouter联合a16z发布的《State of AI》报告。详细探讨了谷歌Titans架构及其理论框架MIRAS,还提及业界对LLM记忆力的改进方案。

机器之心
开源动态8

装机量超2000万、全球主流GPU与AI框架“开箱即用”!OpenCloudOS成AI时代优先选项

在大模型训练迭代快、算力需求高但 GPU 利用率低、生态碎片化的背景下,2025 OpenCloudOS 操作系统生态大会举办。OpenCloudOS 围绕 AI 升级技术,构建能力闭环,还发布智能基座,降低产业链技术摩擦。

InfoQ
算法论文8

全图与切片并非等价?LLaVA-UHD-v3揭示差异推出高效全图建模方案

随着多模态大模型发展,处理高分辨率图像成关键。主流视觉编码范式难兼顾性能与效率,清华和中科院团队发布 LLaVA-UHD v3,提出 PVC 框架,对比 SBE 和 GNE,验证其在提升效率同时保留模型能力。

机器之心