「后Transformer时代」共找到 3192 篇相关文章
更高智商更快思考!蚂蚁开源最新万亿语言模型,多项复杂推理SOTA
蚂蚁正式发布拥有万亿参数的通用语言模型Ling-1T,超越多个开源和闭源模型,在多项复杂推理基准中取得SOTA表现。它推理和代码能力强,研发采用‘中训练+后训练’,还提出新奖励机制和LPO方法。
OpenAI入股AMD,股价暴涨35%!奥特曼左手黄仁勋,右手苏姿丰,通吃全球算力
OpenAI宣布与AMD达成战略合作,将部署6GW的AMD Instinct MI450 GPU集群,可认购最多1.6亿股AMD普通股,持股比例或达10%。消息公布后,AMD盘前股价飙升35%。此前OpenAI也官宣与英伟达合作。
英伟达:RLP 让 AI 在预训练时就学会思考
英伟达研究团队发布 RLP 技术,与传统大语言模型训练不同,它在预训练阶段就让模型学会'先想后说'。通过奖励机制自我监督,实验效果惊人,性能提升显著,不挑数据,打破了大模型训练范式。
首个代码世界模型引爆AI圈,能让智能体学会「真推理」,Meta开源
Meta重组后的AI部门推出首个代码世界模型CWM,是320亿参数开放权重LLM。它与传统大模型思路不同,能模拟代码执行。CWM在通用编程与数学任务表现不错,Meta还开放相关检查点以支持研究。
大模型虽好,但恕我直言:在OCR面前,开源小模型更香
作者所在公司项目需处理大量纸质文档,起初考虑云端大模型API调用和开源大模型本地化部署,却因成本高、硬件要求高受阻。后经推荐调研PaddleOCR,其功能全、成本低、易用性强,最终被选为项目核心方案。
别再幻想 Vibe Coding 打天下,AI 编程最实用的功能是这个
OpenAI 创始成员 Andrej 起初提出 Vibe Coding,后改变观点,称应让不同工具在不同场景各司其职,且其常用 AI 编程功能是代码补全。字节跳动 IDE Trae 里的 Cue 功能在代码补全领域下足功夫,体验出色。
刚刚,光刻机巨头ASML杀入AI!豪掷15亿押注「欧版OpenAI」,成最大股东
路透消息,光刻机巨头ASML豪掷15亿美元领投Mistral AI,成其最大股东。本次C轮融资约20亿美元,完成后Mistral将成欧洲最有价值AI公司。Mistral技术能与ChatGPT匹敌,开源理念使其发展迅速。
AI终端驱动下的芯片产业:新周期的起点与方向|甲子引力X
在8月21日的投资大会上,六位半导体领域顶级投资人剖析AI时代芯片破局路。他们认为中国虽在核心制造与软件生态是“跟随者”,但贴近终端等构成独特优势,还探讨突破壁垒、应对困境之法及未来投资方向。
The Batch: 873 | 通过自监督学习实现更好得图像处理
Meta等团队发布DINOv3权重和训练代码,参数规模扩6倍,用更多数据并引入新损失函数。它在图像分割和深度估计表现卓越,解决了自监督训练的视觉transformer的问题,提升全局和局部任务表现。
沉寂一个月,openPangu性能飙升8%!华为1B开源模型来了
华为发布专为昇腾端侧硬件打造的openPangu Embedded - 1B模型,仅10亿参数却性能卓越。它运用多阶段训练和优化,在权威基准表现亮眼,V1.1平均分较上月跃升超8%,还介绍了背后技术。