新算法框架」共找到 5165 篇相关文章

开源动态8

华人学生立大功!王Mamba-3直击Transformer死穴,推理效率碾压7倍

一代开源架构Mamba-3发布,由CMU普林斯顿原班人马打造,15亿参数性能比Transformer高4%,长序列任务端到端延迟仅为其七分之一。它采用设计哲学,推理优先,有三大核心技术,还能与自注意力层混合提升检索能力。

新智元
新闻资讯8

天终启,万象智生!从AlphaGo到GPT-5,智元十年见证ASI创世纪

2025年9月7日智元举办十周年峰会,主题为「天终启,万象智生」,汇聚多位重量级嘉宾探讨AI前沿突破。当下AI发展迅猛,大模型密集发布,如OpenAI的GPT - 5、谷歌的Gemini 2.5等,中国造大模型也在开源领域领先。

新智元
新闻资讯8

天终启,万象智生!从AlphaGo到GPT-5,智元十年见证ASI创世纪

2025年AI迈向ASI,智元迎十周年,9月7日将在北京举办峰会。众多大咖齐聚,探讨芯片、大模型等前沿突破。今年大模型发布密集,如OpenAI、谷歌等有成果,中国造大模型也表现出色,未来智能体等将爆发。

新智元
新闻资讯7

AI全国榜单爆冷,全网吃瓜大狂欢!这家黑马竟靠DeepSeek杀进全国TOP 2

QuestMobile报告显示,夸克月人均使用次数居AI搜索第一,微博智搜凭DeepSeek排第二,腾讯「闻妹」第三。实测发现,夸克产品力强,微博智搜让信息获取高效,闻妹有划词提问等功能,AI搜索正重塑格局。

新智元
算法论文8

Apple发布SOTA Manzano:混合Tokenizer破解多模态统一难题,理解与生成双翼齐飞

多模态AI前景广,但现有模型在理解和生成任务上存在性能冲突。苹果提出Manzano模型,用混合视觉标记器降低任务冲突,结构简单可扩展,在多基准测试达SoTA水平,还展示图像编辑潜力。

深度学习自然语言处理
算法论文8

ICML 2025 | 千倍长度泛化!蚂蚁注意力机制GCA实现16M长上下文精准理解

在大语言模型发展中,长文本建模挑战大。蚂蚁研究团队提出注意力机制GCA,可端到端学习检索相关片段,实现超长序列处理与泛化,其Triton kernel实现已开源,论文被ICML 2025接收。

机器之心
开源动态8

比NanoBanana更擅长中文和细节控制!兔展&北大Uniworld V2刷SOTA

兔展智能与北京大学的UniWorld团队推出图像编辑模型UniWorld - V2,它提出UniWorld - R1框架,在权威测试中超越顶尖闭源模型。该框架通用性强,能提升其他基础模型性能,相关论文、代码和模型已开源。

量子位
算法论文8

多模态BUG修复SOTA:慕尼黑工大GUIRepair登上SWE-bench Multimodal榜单第一

自动化修复软件缺陷是长期目标,多模态问题修复受关注。慕尼黑工业大学团队提出GUIRepair,融合APR与GUI Testing知识,登上SWE - bench Multimodal榜单第一,为多模态软件自动修复开辟路。

机器之心
新闻资讯7

综述连arXiv都不给发了?最严规出台:被会议、期刊接收才行,workshop都不行

arXiv出台规,计算机科学分类下综述和立场论文须先被正式期刊或会议接收且完成同行评审,投稿时要提供证据。因此类文章数量多、质量差,规引发热议,有人认为太严。

机器之心
推荐文章7

默认选择 React,等于是在扼杀前端创

文章指出默认选 React 正减缓前端创。如今团队选前端常出于习惯而非技术契合度,使 Svelte、Solid、Qwik 等创框架难被采用。默认选 React 还带来运行成本、架构惰性等问题,呼吁根据需求选框架

InfoQ