小目标注意力模块」共找到 994 篇相关文章

开源动态7

GLM-5登顶开源模型No.1!智力指数首破50大关,打平Opus 4.5

在Artificial Analysis评测中,GLM - 5成开源权重模型智力排名第一,是首个智力指数破50的开源模型,除代码能力外各方面表现出色。它集成DeepSeek稀疏注意力,参数规模大,擅长“搞钱”任务,幻觉率低且输出精简。

AI寒武纪
新闻资讯7

天孚通信市值1600亿,小镇青年如何逆袭江西宜春首富?

A股市场上,由新易盛、中际旭创、天孚通信组成的光模块“易中天”走红。天孚通信市值达1600亿,其创始人邹支农出身农村,带领公司造出国产陶瓷套管并上市。公司前瞻性布局契合AI算力需求,深度绑定英伟达,业绩增长显著。

芯师爷
产品应用8

Agnes:不做通用型智能体丨对话全民AI应用平台Agnes AI

量子位智库对话Agnes AI创始人Bruce Yang,探讨多智能体在AI产品的应用。Agnes AI以Multi Agent架构为核心,上线四月日活破20万。其介绍了核心功能、单多智能体差异、评估维度等,还谈及目标人群、市场规模等内容。

量子位
产品应用7

提效40%?揭秘AI驱动的支付方式“一键接入”系统

文章围绕AI驱动的支付方式“一键接入”系统展开。先指出跨境支付接入流程痛点,介绍借助Qwen Coder + MCP工具链构建提效系统的目标。接着阐述技术架构、流程,以及提升AI采纳率的方法,最后展示效果、规划未来。

阿里云开发者
新闻资讯8

强化学习之父Richard Sutton最新采访:LLM是“死路一条”

强化学习之父Richard Sutton在采访中批判当前由LLMs主导的AI发展路径,认为其是死胡同,缺乏真实世界模型与目标。他构想‘经验时代’新范式,预言权力向更高级智能转移,也指出未来面临腐败与价值观挑战。

AI寒武纪
算法论文7

超越Claude 3.5和o1!8B模型靠「分层投票+测试时训练」逆袭

近日MIT研究者发现测试时训练在大模型应对复杂推理问题时,能分解任务提升回答准确率。8B的lemma3模型经此方法,在ARC和BBH数据集上性能显著提升,超Claude 3.5等。但该策略部署效率低。

新智元
新闻资讯7

OpenAI最强对手出现!马斯克发布Grok-4,性能碾压Claude 4两倍!

半小时前马斯克发布Grok - 4,虽Grok3.5跳票、直播迟到被吐槽,但它训练量和算力投入大。在多项基准测试中碾压Claude Opus 4,还具备原生工具调用等能力,xAI目标是让其更快更智能。

探索AGI
推荐文章7

AI Agent 的工程化被低估了

文章指出 AI 发展中工程化作用被低估,将其分为产品工程和技术工程拆解构建 AI Agent 体系。产品工程涵盖需求建模、UI/UX 设计等模块;技术工程涉及架构模块化、流量控制等方面,还提及 Spring AI Alibaba 等工具。

阿里云开发者
算法论文7

基于Memory Bank的Cursor长会话记忆内存库理论研究与实践

文章围绕Memory Bank展开,介绍其为解决大模型长会话记忆瓶颈而设计的机制,包括存储、检索、更新模块。阐述其在编程和知识库建设的应用,还评测了Codelf等工具,指出Memory Bank是AI迈向智能的重要一步。

阿里云开发者
推荐文章7

2个月,20亿美元估值、硅谷7500万美元投资,Manus给中国AI创业者指了条什么路?

文章以Manus为例,分析其国内被质疑、海外却受青睐的原因。指出它虽无自有模型,但为巨头带来增量价值。还借量子隧穿效应说明其先发红利,最后探讨其挑战、目标及对“套壳”看法。

Founder Park