路演大会」共找到 5981 篇相关文章

产品应用8

将DSA注意力引入多模态,快手Keye2.0开启强化推理新范式

快手发布新版多模态模型Keye-VL-2.0-30B-A3B,率先将DSA机制引入多模态理解场景,解锁256K超长上下文深度感知,还首次解锁Agent协作机制。该模型在多方面表现出色,且将融入业务带来收益。

量子位
开源动态8

工业级 LLM 数据工程:北京学 DCAI 团队 DataFlow 框架的架构设计与实践

2026 年模型研发从‘模型中心’向‘数据中心’演进,数据语义密度与工程精度成突破关键。北京学 DCAI 团队推出 DataFlow 框架,解决数据准备难题,其技术报告登顶 Hugging Face。该框架有多种特性,实验验证其能提升模型性能。

InfoQ
新闻资讯8

北京亮牌了:4500亿,要把AI卷到底

1月5日,'2026北京人工智能创新高地建设推进'召开,透露北京要在AI上搞动作。2025年北京AI核心产业规模预计突破4500亿,还将建AI创新街区,发布多项补贴政策,多家机构和企业有新成果。

AGI Hunt
算法论文8

为什么给机器人装上昂贵的触觉传感器,反而让它变笨了?

伊利诺伊学香槟分校等多校合作研究发现,当前机器人学习主流的多传感器融合算法(特征拼接)在处理任务时存在局限,给机器人加触觉数据使抓取成功率暴跌。研究提出组合策略解决问题,经测试效果显著。

机器之心
新闻资讯7

AI编程工具一键删光整个数据库还试图隐瞒?Replit 爆出最致命事故,官方连夜补锅

网友 Jason 痛斥 Replit AI 删除其公司整个生产数据库,Replit 曾称无法回滚,实际却成功回滚。Replit 创始人回应称补偿并复盘,还介绍了公司技术与发展情况,此事引发网友对氛围编码等的讨论。

AI前线
算法论文8

模型遗忘不代表记忆抹除!首次系统发现「可逆性遗忘」背后规律

研究人员发现语言模型遗忘并非简单信息删除,可能藏于内部。他们构建表示空间诊断工具,区分可逆与不可逆遗忘,揭示真正遗忘是结构抹除。还在多种方法、数据集和模型上实证,得出系列结论。

新智元
算法论文8

Knowledge还是Reasoning?具体分析LLM答案正确,不代表思考过程靠谱的问题

斯坦福/加州学团队指出模型答案正确不代表思考过程靠谱,传统评估忽略思考路径问题。团队提出双维度评估框架,透视模型思考过程,还测试发现不同领域决胜关键、最佳训练法不同,且框架正解锁新场景。

深度学习自然语言处理
新闻资讯8

图灵奖得主杨立昆:中国人并不需要我们,他们自己就能想出非常好的点子

本文是对图灵奖得主杨立昆的访谈,他批判当前语言模型局限性,指出难以靠扩规模达人类水平AI。还强调理解世界需非生成式架构,如JEPA。同时以DeepSeek为例,称开源发展更快,中国人能想出好点子。

AI科技大本营
产品应用9

我给阶跃星辰 Step 5 Preview 出了一道工程题

本文作者池建强参与阶跃星辰新一代旗舰模型Step 5 Preview小范围内测,设置带两层bug和隐藏需求的编码工程题,与Qwen 3.8 Max、Kimi K3对比测试,分享实际项目使用体验,给出客观评测。

MacTalk
新闻资讯7

Momenta港股上市:一个智驾供应商为何要讲物理AI?|甲子光年

今日Momenta在港交所上市,此前赴美上市搁浅。虽盈利状况优于同行,但研发投入,累计亏损高。上市前夕其从‘自动驾驶公司’变为‘物理AI公司’,欲用物理AI模型打通多市场,这也是行业趋势。

甲子光年