Kimi Delta 注意力」共找到 368 篇相关文章

新闻资讯8

聊聊 Token 出海的生意经:模型开源给世界,中国赚什么?

本文围绕中国开源模型展开,介绍了 Cursor 使用 K2.5 模型事件,阐述了开源模型供应链,分析了中国开源模型受欢迎原因,探讨小公司技术机会,还提及开源面临的挑战及未来趋势,指出其正改变全球 AI 基础设施格局。

刘言飞语
算法论文8

突破一亿Token极限:EverMind提出MSA架构,实现大模型高效端到端长时记忆

机器之心发布文章介绍,大模型长期记忆能力受限于上下文长度。《MSA: Memory Sparse Attention for Efficient End-to-End Memory Model Scaling to 100M Tokens》提出MSA架构,突破扩展性、精度和效率的不可能三角,实现100M长度的大模型长时记忆框架。

机器之心
算法论文8

大象秒变挖掘机!三维变形新突破,无需额外训练 | CVPR'26

南京大学与北京大学提出MorphAny3D,无需额外训练即可让三维生成模型实现跨类别平滑变形。它通过创新注意力机制融合源与目标特征,精准控制结构与时序,效果远超传统方法,代码已开源。

新智元
开源动态7

我手搓了一个Seedance 2.0分镜Skill:一键生成电影级Prompt,再也不用为提示词发愁了

作者为解决用Seedance 2.0写分镜提示词难题,手搓Seedance Storyboard Skill。它能引导用户完成分镜细节,输出专业提示词。作者实测4种风格案例效果佳,还介绍了Skill原理、安装使用方法。

AI寒武纪
算法论文8

AAAI 2026杰出论文奖 | ReconVLA:具身智能研究首次获得AI顶级会议最佳论文奖

具身智能常被视为‘系统工程驱动’研究方向,ReconVLA获AAAI杰出论文奖,是具身智能方向首次获AI顶级会议最佳论文。它解决VLA模型关键瓶颈,通过重建式隐式视觉定位机制,实验效果显著。

机器之心
开源动态8

罗福莉携小米MiMo-V2-Flash首次亮相:一次在推理与Agent上的下注|甲子光年

大模型进入新阶段,效率成能力一部分。小米MiMo团队12月16日晚发布并开源MiMo - V2 - Flash,负责人罗福莉首亮相。该模型在推理、编程和智能体场景表现出色,在架构、训练方法等有创新。

甲子光年
推荐文章8

DeepSeek V3到V3.2的进化之路,一文看全

知名AI研究者Sebastian Raschka发布深度博客,详细梳理DeepSeek V3到V3.2进化历程。DeepSeek V3.2性能对标GPT - 5和Gemini 3.0 Pro,且为开放权重模型,报告涵盖众多有趣领域和知识。

机器之心
产品应用8

模型测试不再跳来跳去,VS Code + Hugging Face = 真香

Hugging Face 发布新功能,让开发者在 VS Code 的 GitHub Copilot Chat 中直接接入 Inference Providers,可调用 Kimi K2 等开源大模型测试,无需频繁切换平台。该功能有统一 API 等优势,定价门槛低。

InfoQ
产品应用8

手机“自动驾驶”时代来了,智谱还让手机拥有“云替身”

作者参加智谱AutoGLM新版本闭门会并试用,该版本亮点多,如成全球首个手机通用Agent,操作在云设备运行,全平台覆盖等。云手机Agent能力稳定高效,能处理多类任务,还可助老人等群体用手机。

歸藏的AI工具箱
新闻资讯8

DeepSeek V4 借实习生获奖论文“起飞”?梁文峰剑指上下文:处理速度提 10 倍、要“完美”准确率

ACL公布2025年获奖论文,中国作者比例超51%。DeepSeek梁文锋通讯、实习生袁境阳一作的论文获Best Paper奖。其提出NSA机制,实验显示性能优、准确率高、速度提升显著,成果或用于DeepSeek V4。

InfoQ