全注意力机制」共找到 2720 篇相关文章

开源动态8

从今天起,开源前五,!是!中!国!大!模!型!

短短一年,LMArena开源模型榜单前五被中国大模型占领,智谱Z.ai登顶,阿里、DeepSeek等紧随其后。LMArena是权威评测平台,盲测机制保证排名真实。中国模型性价比高,正用开源和低价占领市场。

AGI Hunt
产品应用8

网首测!首款国产GPU「AI算力本」现场上手

新智元报道首款国产GPU「AI算力本」MTT AIBOOK,它搭载国产功能显卡,预装开发环境,打破系统壁垒。其背后的MUSA架构栈自研,软件升级、有翻译工具,硬件架构革新,还有开源计划,产品应用广泛。

新智元
产品应用8

借鉴人脑「海马体-皮层」机制,红熊AI重做了一个「记忆系统」

记忆成AI进化关键,Google Research新论文提出「嵌套学习」范式。红熊AI受业务难题启发,推出「记忆熊」,借鉴人脑机制重构记忆系统,在多场景应用落地,提升了服务质量和效率。

机器之心
产品应用8

数字生活的原生入口:蚂蚁集团发布AI眼镜新技术框架gPass

日前,蚂蚁集团在2025 Inclusion・外滩大会发布球首个智能眼镜可信连接技术框架gPass,具备“安、交互、连接”能力,可解决AI眼镜生态痛点,已应用于部分品牌,未来将释放更多潜能。

机器之心
新闻资讯7

Claude骂声中启动「隐形水印」:新模型量嵌入,标记所有文字

Anthropic宣布新款Claude将在生成文本中嵌入隐形水印,还会给特定文件附加数字签名元数据,球统一施行。此前A社就用Unicode贴暗标,虽称不影响生成质量,但遭质疑。

量子位
产品应用8

DeepSeek-R1升级V2版:Token成本低至原来30%

DeepSeek - R1 V2版维度升级,训练框架从‘单一RL’到‘多阶段协同优化’,推理能力从‘能推理’到‘会优化推理’,还提升了安可控性,适配生态,推出轻量级模型。

CourseAI
新闻资讯7

为 AI 智能体设计记忆机制:揭秘 LinkedIn 的认知记忆智能体

LinkedIn推出认知记忆智能体(CMA),作为生成式AI技术栈一部分,解决大语言模型缺乏状态记忆问题。CMA有三层记忆,集成多种机制,在多智能体系统中作用关键,还将人工校验融入招聘应用。

InfoQ
新闻资讯8

C罗刚头球破门,AI解说脱口而出!模态实时流太狠了

2026世界杯正热,阿里云在Flink Forward Asia 2026大会宣布Apache Flink 3.0进入Agentic Streaming For AI时代,推出模态数据流处理能力,可让AI实时解说比赛。Flink 3.0解决了流式Agent数据处理难题,已有智能运维等应用场景。

新智元
推荐文章8

DeepSeek V3到V3.2的进化之路,一文看

知名AI研究者Sebastian Raschka发布深度博客,详细梳理DeepSeek V3到V3.2进化历程。DeepSeek V3.2性能对标GPT - 5和Gemini 3.0 Pro,且为开放权重模型,报告涵盖众多有趣领域和知识。

机器之心
产品应用8

杭州再出王炸!医疗影像黑马德适推出iMedLoop:打通医疗AI链路

7月4日,德适科技发布iMedLoop,它是医疗影像数据合规协同平台,打通医疗AI链路。其基于iMedImage、iMedStudio和iMedMaaS搭建,让医疗AI转向“轻量化、高效率”,已积累大量数据和模型。

AI寒武纪