大V」共找到 5430 篇相关文章

开源动态8

社区供稿丨如何抑制模型的“过度反思”:Yuan3.0 Flash 中的强化学习范式

模型在企业落地时存在“过度反思”问题,浪费算力。YuanLab.ai团队在Yuan3.0 Flash模型中提出RIRM与RAPO,前者奖励“思考过程”,后者优化训练框架,实现推理效率提升,适用于企业场景。

Hugging Face
新闻资讯7

劝人退学、庆幸没读博浪费5年,26岁DeepMind“传奇人物”:厂内部分散,AI研究很低效

26岁的Neel Nanda是DeepMind“传奇人物”,他涉足机械可解释性研究四年成果丰硕。在与主持人对话中,他分享经验,认为厂内部分散、AI研究低效,还谈及读博、AI安全研究、公司决策等看法。

AI前线
7

DeepSeek V4还能更省!新工具缓存命中率高达99.82%,2折稳定到手

DeepSeek V4系列发布1个月,官方永久降价,开源社区的Reasonix项目将缓存命中率干到99.82%,能幅降低成本。它专为DeepSeek打造,实现思路基于其缓存机制,安装使用简单。

量子位
算法论文8

AAAI 2026|视频语言模型到底可不可信?23款主流模型全面测评来了

合肥工业学与清华学团队推出视频语言模型综合可信度评测基准 Trust-videoLLMs,对 23 款模型从五维度 30 项任务评测,揭示性能格局,指出模型现存问题,还开源评测框架等。

机器之心
产品应用8

比英伟达早,比李飞飞强,晓Kairos原生一体化世界模型定义物理AI新路线

晓机器人发布 Kairos 开悟世界模型,其首创“多模态理解 — 生成 — 预测”原生一体化架构,采用跨具身渐进式训练体系和“以人为中心”的数据金字塔,还实现端侧部署,在四权威具身智能基准上全面登顶。

机器之心
开源动态8

刚刚!Meta把模型塞进脑机接口,隔空读脑直逼开颅植入水平,代码全开源

Meta推出Brain2Qwerty v2,号称性能最强端到端方案,能基于非侵入式脑部记录实现实时句子级解码,准确率逼近开颅手术水平。还开源代码,公开数据集,旨在帮脑损伤患者交流。

AI寒武纪
开源动态8

2 天斩获 3.5K 标星!GitHub 惊现神器!一个二进制文件把 DeepSeek V4 搬进终端

GitHub上的DeepSeek TUI项目开源两天获3.5K Star,它把DeepSeek V4模型搬进终端成编码智能体,有原生RLM并行推理等亮点,提供多种安装方式、支持多提供商,适合终端开发者。

开源星探
产品应用8

医疗幻觉率比DeepSeek低3倍,百川循证增强模型横扫全球医学考试!

百川智能发布首个循证增强医疗模型Baichuan - M2 Plus,将循证医学理念融入训练和推理,首创六源循证范式。其在多场景评测中幻觉率低,多国医考成绩优异,已上线百小应APP并开放API。

新智元
开源动态8

刚刚,小红书开源了首个多模态模型dots.vlm1,性能直追SOTA!

小红书人文智能实验室(hi lab)低调开源视觉语言模型dots.vlm1。该模型基于自研视觉编码器构建,在视觉理解和推理任务上接近SOTA水平,实测表现惊艳,还介绍了其技术架构、预训练数据布局等内容。

新智元
算法论文8

AAAI 2026 Oral | 模型「爱你在心口难开」?深度隐藏认知让推理更可靠

合肥工业学团队提出模型存在‘隐藏的真伪认知’,论文让模型用此给推理‘打分’,过滤错误推理链。通过多层注意力头探测、构建预测器和新推理扩展策略,提升了推理链稳定性,实验效果优异。

机器之心