新注意力机制」共找到 4298 篇相关文章

算法论文8

清华大学x生数科技:从波形到隐空间,AudioLBM引领音频超分范式

音频超分辨率是提升音频体验的关键技术,但高频细节损失是挑战。OpenAI的Sora 2树立高保真音频生成标杆,现有学术模型有局限。清华与生数科技团队发表两项成果,AudioLBM展现通用高分辨率音频生成潜力。

量子位
新闻资讯8

Claude网页版接入MCP!10款应用一键调用,开发者30分钟可创建集成

Claude网页版接入MCP,集成10款应用,开发者30分钟可创建集成。同时Research功能更,增加更多数据来源,网页搜索功能面向付费用户开放。MCP逐渐成为行业标准,引发对大模型SaaS时代的讨论。

量子位
产品应用8

Claude Skills,4000字详解 Anthropic 的思考

Anthropic推出技能Claude Skills,作者认为它会引导第三方工具形态。Skills结合笔记式形态、可执行工具与AI调度自优化,具备低门槛、灵活表达等优势,还实现了AI自我进化,是一种范式。

AI产品自由
推荐文章8

从DeepSeek-V3到Kimi K2:八种现代 LLM 架构大比较

文章对比了DeepSeek-V3、Kimi K2等八种现代LLM架构。介绍各模型独特技术,如DeepSeek V3的多头潜在注意力和混合专家技术,OLMo 2的后归一化策略,Gemma 3的滑动窗口注意力等,探讨架构改进与突破。

PaperAgent
产品应用8

从网页截图到精准复刻只需30秒:这个模型刷了我的认知

智谱AI发布GLM - 4.6V系列模型,是首个支持工具调用的视觉模型。作者对其进行7个场景测试,如识别鸟类、分析赶海地点等,展现出不错性能。该模型速度快、开源,有优势也有小问题,适合开发者和普通用户。

花叔
新闻资讯8

医生版 ChatGPT 3 年估值 60 亿美金,被低估的 AI 硬件玩法:相框

OpenEvidence被称为医学领域的Google和医生版ChatGPT,成立3年估值达60亿美金。它用高质量数据训练小而专模型,有“无幻觉”机制,直接面向医生推广,产品进化为临床决策助手,收入来自制药广告。

投资实习所
算法论文8

谁说Scaling Law到头了?研究:每一步的微小提升会带来指数级增长

很多人质疑扩大计算规模训练模型的做法,因Scaling Law面临收益递减。但研究发现,模型单步准确率的微小提升能使完成任务长度指数级增长,还探讨了长程执行能力的衡量及影响因素。

机器之心
新闻资讯7

身家1100亿,“玻璃女王”冲向AI硬件

随着iPhone 17热卖,蓝思科技营收创高,创始人周群飞身家达1100亿。为摆脱对苹果依赖,公司布局能源汽车、AI眼镜、人形机器人等AI硬件赛道,但业务成果待察,毛利率也在下滑。

芯师爷
新闻资讯7

DeepSeek V3.2爆火,Agentic性能暴涨40%解密

文章解密了DeepSeek V3.2 Agentic性能暴涨40%的原因,即采用交错思维链机制。还对比了其与早期ReAct范式,介绍其效果、原理,以及MiniMax为落地该机制做的工作,最后提到多家模型达成技术共识。

新智元
算法论文8

夜间感知突破!北航等提出红外主导的高效目标检测方案 | ECCV'26

在复杂视觉场景中,传统RGB - IR多模态检测方法在低照度等场景下因RGB退化影响检测效果。北航等团队提出的InfraNet,以红外为主,用质量感知机制控制RGB引导,在多数据集取得强竞争力结果。

新智元