「M2模型」共找到 8646 篇相关文章

算法论文7

基于Memory Bank的Cursor长会话记忆内存库理论研究与实践

文章围绕Memory Bank展开,介绍其为解决大模型长会话记忆瓶颈而设计的机制,包括存储、检索、更新模块。阐述其在编程和知识库建设的应用,还评测了Codelf等工具,指出Memory Bank是AI迈向智能的重要一步。

阿里云开发者
新闻资讯8

去了一趟中国AI实验室,Linux基金会CTO感叹:西方那两套偏见全破产了

Linux 基金会全球 AI 技术官 Matt White 访华后称,西方对中国 AI 的偏见破产。中国实验室文化黏性强、人才回流,工具反向输出美国。他指出西方出口管制未卡死中国,还让其成自研芯片‘卷王’,开源模型也更受青睐。

AI科技大本营
新闻资讯7

Mira Murati 创业公司首发长文,尝试解决 LLM 推理的不确定性难题

OpenAI前CTO Mira Murati创立的Thinking Machines Lab首发文章《克服LLM推理中的不确定性》,指出大语言模型推理难获可复现结果,深入探究其不确定性根源,提出使核函数具备批次不变性的方法并给出实现与实验。

Founder Park
新闻资讯8

菲尔兹奖得主都栽了!Claude终结78年悬案,或成最重要AI数学成果

78年数学难题“六维球面上有无复结构”被哈佛数学家Levent Alpöge和Claude解决,他们绕开老路造出答案,还给出108页论证,数学家挑不出毛病。Alpöge在35天内三次用AI破难题,这次性质不同,是模型创造新对象。

新智元
算法论文8

欲取代transformer的SSA(次平方稀疏注意力)解读

文章解读了欲取代Transformer的SSA(次平方稀疏注意力)算法。它支持12M tokens上下文,比fastAttention快52倍,训练和推理更快。SSA改变了注意力扩展特性,有计算和内存线性扩展等特性,经三阶段训练可可靠利用长上下文。

Agent的潜意识
开源动态7

GPU-MODE Leaderboards之vector_add histogram 以及一些有趣发现

文章介绍GPU-MODE Leaderboards中vector_add和histogram任务。分析vector_add实现、带宽利用率,rank1代码用cccl,带宽利用率超80%;histogram算子瓶颈在atomic冲突等,rank1也多用cccl,还给出rank2代码,最后提及任务中Hack行为及代码提交方式。

GiantPandaLLM
推荐文章7

「Memory as a Context」是否将重新定义 Transformer 的 「记忆模式」?

本期机器之心PRO会员通讯解读3个AI业内要事,包括「Memory as a Context」能否重新定义Transformer记忆模式、世界模型发展情况,以及OpenRouter联合a16z发布的《State of AI》报告。详细探讨了谷歌Titans架构及其理论框架MIRAS,还提及业界对LLM记忆力的改进方案。

机器之心
产品应用7

Anthropic 突发 Sonnet 5,但大家更期待 Fable 5 和 Mythos 5 明天解禁

昨夜凌晨,Anthropic 突然推出 Claude Sonnet 5,自封“性价比之王”。它重点提升计划制定等能力,价格更低,安全性能提升,但网络安全能力弱于 Opus 4.8 和 Mythos 5。不过用户反馈平淡,Anthropic 面临高端模型受阻和访问控制争议等问题。

InfoQ
开源动态7

Sora 模糊视频有救了!强大的免费开源AI视频处理工具!硬件要求低!

Video2X-QT6是免费开源AI视频处理工具,支持视频超清放大、补帧,兼容CPU和GPU,低配置电脑也能用。6.0.0版本用C/C++重写,速度快、跨平台,还能处理图片。介绍了不同系统安装方法等。

GitHubStore
推荐文章7

从Rax+DX到React,一次跨端组件重写的AI提效探索

本文基于M站首页重构项目,讲述借助AI编程工具Cursor和结构化Prompt,完成从Rax到React的组件迁移、DX到React的跨端重写,实现业务逻辑优化与工程规范落地,还分析了AI提效的优劣并总结迁移范式。

阿里云开发者