新注意力机制」共找到 4357 篇相关文章

产品应用8

这是我花9毛钱拍的《Meta老板砸钱把我从苹果挖走》

国产AI开启Level,生数科技的Vidu Q1参考生视频功能,9毛钱+4张图就能生成视频。它重定义叙事,砍分镜、拍摄等流程;有业内最强一致性;价格低,让AI视频生成“快、好、省”。

量子位
算法论文8

英伟达、港大等发布创KV缓存,实现扩散模型无训练加速

多数开源扩散语言模型推理效率不如自回归模型,英伟达、港大、麻省理工研究人员联合提出Fast - dLLM。它用近似KV缓存机制减少冗余计算,还提出基于置信度的平行解码策略,测试显示能加速且保持生成质量。

AIGC开放社区
算法论文8

思维锚点:破解LLM Reasoning黑箱的关键句

文章提出思维锚点概念,指推理轨迹中影响后续步骤和答案的关键句。开发三种归因方法,系统论证高级组织句影响力更大,锚点主导错误修正。研究为理解LLM推理机制开辟途径,开源工具支持可视化分析。

深度学习自然语言处理
开源动态8

弃 Python 拥抱 JVM,Spring 之父 20 年后再造“革命性框架”:我从未如此确信一个项目的必要性

Spring 之父 Rod Johnson 开源专为 JVM 生态设计的 AI 智能体框架 Embabel,旨在弥合生成式 AI 的‘承诺’与‘现实’差距。它采用 GOAP 方法保证确定性,有弹性执行与动态重规划能力,还引入多种机制确保可控性与安全性。

InfoQ
新闻资讯8

LeCun亲自官宣!Meta世界模型V-JEPA 2登场!仅用62小时机器人数据,就能实现零样本控制!

Meta发布V-JEPA 2世界模型及三个基准测试,Meta首席AI科学家Yann LeCun介绍其不同。V-JEPA 2基于视频训练,用62小时机器人数据就能实现零样本控制,还将探索分层式模型和多模态建模。

AI科技大本营
算法论文8

Knowledge还是Reasoning?具体分析LLM答案正确,不代表思考过程靠谱的问题

斯坦福/加州大学团队指出大模型答案正确不代表思考过程靠谱,传统评估忽略思考路径问题。团队提出双维度评估框架,透视模型思考过程,还测试发现不同领域决胜关键、最佳训练法不同,且框架正解锁场景。

深度学习自然语言处理
产品应用8

对普通人最有用的一次!藏师傅教你用FLUX Kontext解决一切图片问题

黑森林工作室发布生成式流匹配模型 FLUX Kontext,它能编辑图片且不影响未编辑区域,支持多图参考生成图像。可用于去水印、修复照片、修改海报、生成商品展示图等,还能美颜美体,替代 PS 等工具。

歸藏的AI工具箱
算法论文8

独家!哈工大斩获AI顶会ACL评审阶段最高分,让AI领略汉字之美

哈工大论文获AI顶会ACL 2025评审阶段已知最高分。团队用传感器捕捉手部书写实现汉字输入识别,独创中文字形编码让AI理解汉字形态,革中文人机交互,推动汉字文化传承,为AI理解汉字开辟路。

新智元
新闻资讯8

DeepSeek 跃居全球第二 AI 实验室,中美正式并驾齐驱!

Artificial Analysis宣称DeepSeek R1跃居全球第二,其0528版得分达68分,与Google Gemini 2.5 Pro并列。更体现强化学习的重要性,多家云服务提供商也迅速支持模型,这表明开源与闭源模型差距缩小,中美AI并驾齐驱。

AGI Hunt
开源动态7

又一个开源 AI Agent 杀到!II-Agent,号称“全球最强”,击败 Genspark 和 Manus,跑分直逼人类

AI Agent 赛道迎来成员 II-Agent,由 Intelligent Internet 团队打造且将开源,获前 Stability AI CEO 站台。它性能强、可扩展,GAIA 跑分亮眼,团队认为未来是 Agent 群的天下,还计划为多领域构建开源 Agent。

AI进修生