大厂推虾苗」共找到 5497 篇相关文章

开源动态7

FLUX.2开源了,但是我好像也看到了小公司的无力。

AI绘图曾经的王者FLUX.2部分模型开源,包括dev和即将开源的klein。但与Nano Banana Pro对比,其生图、改图及世界知识表现欠佳。这凸显小资源碾压下的无力,但开源仍有价值。

数字生命卡兹克
产品应用8

每2秒吃透一道高数题!华为终于揭秘准万亿MoE昇腾训练系统全流程

华为揭秘准万亿MoE昇腾训练系统全流程,通过“昇腾+Pangu Ultra MoE”实现国产算力与模型自主可控训练闭环,从集群利用率、单节点算力、后训练技术三方面突破,实现模型高效训练。

量子位
算法论文8

AI画手总是六根手指?阿/美团/上交首次系统量化扩散模型计数幻觉

阿德莱德学、美团和上海交通学团队首次系统研究扩散模型“计数幻觉”问题。构建CountHalluSet数据集套件量化该问题,揭示其与采样条件的关系,还提出JDM模型缓解计数幻觉。

量子位
新闻资讯7

模型是「躲在洞穴里」观察世界? 强化学习佬「吹哨」提醒LLM致命缺点

加州学伯克利分校副教授、强化学习牛Sergey Levine在博客指出,当前语言模型(LLM)只是对人类脑和思维的间接「扫描」,如同被困洞穴看人类智慧「投影」,无法代替真正思维。

机器之心
算法论文8

Speech LLM 的下一个突破口:你的语音模型可以是个「带韵律的文本模型」

语音模型存在‘模态代沟’致性能‘降智’,此前两波改进未根本解决。香港中文学论文提出TextPro - SLM架构,从输入端破局,仅用约1000小时数据就实现低‘模态代沟’,对多模态模型设计有启发。

机器之心
开源动态8

性能比肩DeepSeek-R1,MiniMax仅花380万训出模型性价比新王|开源

MiniMax开源模型MiniMax - M1,原生支持100万token输入、8万输出,性能比肩DeepSeek - R1,仅花380万训成。采用Lightning Attention机制与CISPO算法,在多领域表现出色,模型权重可在HuggingFace下载。

量子位
开源动态8

社区供稿丨如何抑制模型的“过度反思”:Yuan3.0 Flash 中的强化学习范式

模型在企业落地时存在“过度反思”问题,浪费算力。YuanLab.ai团队在Yuan3.0 Flash模型中提出RIRM与RAPO,前者奖励“思考过程”,后者优化训练框架,实现理效率提升,适用于企业场景。

Hugging Face
算法论文8

AAAI 2026|视频语言模型到底可不可信?23款主流模型全面测评来了

合肥工业学与清华学团队出视频语言模型综合可信度评测基准 Trust-videoLLMs,对 23 款模型从五维度 30 项任务评测,揭示性能格局,指出模型现存问题,还开源评测框架等。

机器之心
产品应用8

比英伟达早,比李飞飞强,晓Kairos原生一体化世界模型定义物理AI新路线

晓机器人发布 Kairos 开悟世界模型,其首创“多模态理解 — 生成 — 预测”原生一体化架构,采用跨具身渐进式训练体系和“以人为中心”的数据金字塔,还实现端侧部署,在四权威具身智能基准上全面登顶。

机器之心
产品应用8

医疗幻觉率比DeepSeek低3倍,百川循证增强模型横扫全球医学考试!

百川智能发布首个循证增强医疗模型Baichuan - M2 Plus,将循证医学理念融入训练和理,首创六源循证范式。其在多场景评测中幻觉率低,多国医考成绩优异,已上线百小应APP并开放API。

新智元