「1M上下文」共找到 2412 篇相关文章
AGI 新技术路线:下一代稀疏注意力机制 Monte Carlo Attention 开源
超对称技术公司在新版基座模型 BigBang - Proton 中使用的 Monte Carlo 注意力开源。它基于二进制块编码技术,用块间代表交流机制实现线性复杂度,兼具多种注意力机制优点,可满足宇宙尺度建模的上下文长度需求。
Anthropic 断供,国产 Coding 模型的中场战事开启
Anthropic对中国企业断供,国产模型面临成为Claude平替的机遇。Kimi等模型纷纷尝试,Kimi K2 0905版本在编码、上下文及工具调用上提升,其终极目标或构建具Agent特质产品,未来Agent是决胜场。
SSM+扩散模型,竟造出一种全新的「视频世界模型」
在AI热词不断涌现的时代,斯坦福大学等机构研究将长上下文、状态空间模型、扩散模型等结合,创造全新「视频世界模型」。它用状态空间模型实现长期记忆,还设置局部注意力机制,训练和推理表现出色。
Claude Opus 5发布,砍掉了Claude Code 80%的系统提示词
Anthropic发布Claude Opus 5,接近Claude Fable 5智能且价格减半,测评成绩出色,科研和视觉输出能力也有进步。同时发现砍掉Claude Code 80%系统提示词,编码评测分数不变,还总结出上下文工程新方法论。
月吞100万亿Token!AI中转站OpenRouter赚爆了
OpenRouter宣布完成1.13亿美元B轮融资,估值达13亿美元。它每周处理25万亿个tokens,全球用户超800万。其提供AI推理统一控制层,解决企业多模型管理难题,开源模型崛起使其价值凸显。
Claude 活动上这台巴掌大的电脑,被玩疯了
上周Anthropic在开发者大会上,让参会者用Claude Code为巴掌大的M5Stack Cardputer ADV写程序,会后官方展示五个小项目,如摇一摇切换MacBook模式、拼写游戏等,代码开源,设备可带回家。
13人干翻Transformer!新架构SSA算力暴减千倍,成本仅Opus 5%
一款基于SSA架构的AI模型SubQ横空出世,其上下文高达1200万Token,计算量比Transformer暴减1000倍,成本不到Claude Opus的5%。打造它的Subquadratic公司仅13人,产品发布后引发AI社区不同反应。
分享2篇最新Harness论文,一篇谷歌,一篇微软
在LLM Agent迅速发展的当下,如何为其设计合适的Harness成关键问题。本文分享微软M⋆和谷歌AutoHarness两篇论文,分别从记忆系统和动作约束维度提出自动化的Harness进化方法,并介绍了实验结果。
AI 巨头对话:Sam Altman 与 Satya Nadella 论 AI 未来、算力与微软王牌
OpenAI的Sam Altman和微软的Satya Nadella在播客中探讨AI未来等话题。涉及1.4万亿算力投入、微软与OpenAI新合作协议细节,指出瓶颈在数据中心和电力,还谈及AI经济模型、未来愿景等。
首创双NPU架构一鸣惊人!联发科天玑9500重磅加码主动式AI体验
联发科天玑9500首创超性能+超能效双NPU架构,让AI始终在线,融入用户操作。其输出性能、上下文窗口等有显著提升,还解决了模型加载慢等问题,与多厂商合作推动端侧AI落地。