几何上下文注意力」共找到 899 篇相关文章

开源动态8

首篇自进化智能体系统技术报告出炉:Token成本直降近10倍,省钱又高效!

全球首个基于‘上下文信息密度最大化’的自进化智能体系统GA发布技术报告。它在多基准测试表现惊艳,能省近10倍Token,还能自我进化。报告深度解读设计理念,剖析自进化能力与智能体设计思路。

机器之心
开源动态7

GLM-4.7-Flash无审查版发布:30B MoE模型,仅3B激活参数

GLM-4.7-Flash无审查版由HauhauCS发布,基于原版移除审查机制。采用30B - A3B混合专家架构,总参数量31B,每次前向传播仅激活约3B参数,推理快,支持200K上下文长度,有两种变体和四种量化版本。

AI工程化
产品应用8

接入 MiniMax M2.7 后,我的 OpenClaw「超进化」了

作者实测 MiniMax 新模型 M2.7,其在基准测试、代码能力、多智能体协作等方面表现出色。接入 OpenClaw 后,能高效完成复杂任务。M2.7 指令遵循率高、长上下文处理能力强且价格低,有望提升 Agent 生态表现。

特工宇宙
产品应用7

构建能源领域的AI专家:一个多智能体框架的实践与思考

本文介绍阿里团队在能源领域构建多智能体框架的实践。因单智能体处理复杂任务有“注意力发散”问题,团队研发综合能源智能体平台,阐述框架搭建、各组件功能及设计考量,还分享思考与可优化点。

阿里云开发者
推荐文章7

超越 GoF:现代 AI 系统实用设计模式

文章指出AI系统需要设计模式,如GoF塑造软件设计,云计算引入新模式,机器学习社区也有相关模式。文中介绍现代AI系统的5类实用设计模式,含提示和上下文、负责任的AI、用户体验、AI - Ops和优化模式等,并举例说明。

InfoQ
算法论文8

SIGGRAPH 2026 | 无需训练,一段单目视频解锁任意运镜与「子弹时间」

来自UIUC、宾大与Netflix Eyeline Labs的研究团队提出FreeOrbit4D,无需训练模型,用单目视频就能实现任意运镜和“子弹时间”。它通过“前景补全的4D重建”提供几何支架,在大角度视角变化下表现出色,还带来诸多应用。

机器之心
推荐文章8

AI 基础知识从 0.5 到 0.6—— Transformer 架构为何能统治AI领域?

文章围绕Transformer架构展开,先介绍其诞生背景,对比CNN、RNN等模型,阐述其在多领域的核心地位。接着剖析工作流程、实现原理,包括QKV机制、多头注意力等。最后列举T5、GPT等常见架构模型,并提及通义千问3与MCP协议。

阿里云开发者
新闻资讯8

陶哲轩用GPT5-Pro跨界挑战!3年无解的难题,11分钟出完整证明

陶哲轩与GPT - 5 Pro合作解决微分几何领域3年未解难题。GPT - 5 Pro从计算到证明一气呵成,助陶哲轩突破思维局限。陶哲轩认为AI在小、大尺度上有用,中尺度无益,还印证多尺度衡量工具有效性观点。

量子位
开源动态7

MiniMax深夜开源首个推理模型M1,这次是真的卷到DeepSeek了。

MiniMax深夜开源首个推理模型M1,其上下文能力媲美Gemini 2.5 Pro。M1在部分评测中表现中规中矩,但在MRCR(4 - needle)测试中屠榜。它得益于MiniMax - 01基座模型,应用Lightning Attention机制,开源了40K和80K两个版本。

数字生命卡兹克
开源动态8

社区供稿丨Jina-VLM:可在笔记本上跑的多语言视觉小模型

Jina AI发布2.4B参数量的视觉语言模型Jina - VLM,在多语言视觉问答任务达SOTA。它引入注意力池化,连接视觉与语言基座,处理问答等任务,对硬件要求低,多项测试表现优,还介绍架构、训练策略和上手方式。

Hugging Face