「百万Token计算」共找到 1374 篇相关文章
少 61% Token、多10倍成功率,这个终端 AI 编程代理火了!
现在多数AI编程工具问题多,而在Github上火爆的`oh-my-pi`是运行在终端的AI编程代理,有哈希锚定编辑等实用功能,支持多模型,经基准测试效果好,还能解决实际开发痛点。
吃灰 AI 眼镜爆改“交警 Copilot”,函数计算AgentRun 实操记录
作者将吃灰的Meta Ray - ban眼镜爆改成“交警Copilot”,介绍了“端 - 管 - 云”协同框架,分享客户端与服务端开发过程。还探讨用Agent架构和FaaS的原因,指出其在应对需求变化、节省成本等方面优势,最后提及项目待优化处。
模型宣称的“百万字处理能力”是真本事,还是营销噱头?LongCodeBench揭露真相
近年来大模型号称有百万字处理能力,但这是真本事还是噱头存疑。论文用LongCodeBench测评工具揭开长上下文模型真实表现,测试顶尖模型发现长文本能力‘翻车’,还分析了长上下文难的原因及面临的瓶颈。
100万亿Token看懵硅谷!全球一半算力写代码,另一半在「搞颜色」 ?
OpenRouter和a16z联合发布报告,基于100万亿Token实证数据揭秘2025年AI发展。开源模型流量占比达30%,推理模型成主流,编程和角色扮演是主要使用场景,亚洲付费使用量翻倍,中文成全球第二大交互语言。
Windsurf快被Devin搞垮了!bug 不断、官方“装死”,百万用户要“跑”了?
Windsurf近期出现性能降低等问题,社区抱怨不断,但官方却隐身不回应。此前公司经历变动,Devin集成到Windsurf后问题频出,如级联错误、积分消耗等,部分用户开始转向其他产品,其未来发展存不确定性。
1500 个 PR、0 人写代码:Codex 驱动的百万行级内部产品实践
团队在五个月内开发并发布无人工编写代码的内部测试产品,代码均由Codex生成,效率高。介绍了开发过程,如定义工程师角色、增加应用可读性等,还提及面临的挑战及解决办法,分享实践心得。
这一年,DeepSeek消耗14万亿Token,编程仅占1/10,超一半用于角色扮演?
a16z和OpenRouter基于100万亿token研究揭示LLM使用情况:开源模型占三成市场,编程任务成刚需,角色扮演是金矿。还提到‘玻璃鞋效应’影响用户留存,市场分层为‘高端闭源+性价比开源’双轨制。
英伟达下一代GPU登场,Rubin CPX一次推理数百万Token,网友:这是头野兽
在周二的AI基础设施峰会上,英伟达宣布推出专为超100万token长上下文推理设计的Rubin CPX GPU。它将与其他产品组成新平台,性能卓越,还能复用现有平台,预计2026年底上市。
√N并行+84倍计算加速!英伟达港大全新图像注意力:空间结构都保留
英伟达、港大等研究人员提出新型视觉注意力机制GSPN,通过线性扫描和稳定性 - 上下文条件处理图像空间结构,降低计算复杂度至√N量级,在多视觉任务达先进水平,生成16K图像加速超84倍。
RAE+VAE? 预训练表征助力扩散模型Tokenizer,加速像素压缩到语义提取
近期,RAE 提出以「 冻结的预训练视觉表征」作潜空间提升扩散模型性能。同期西安交大与微软亚研院提出 VFM - VAE,结合 RAE 与 VAE,能加速模型收敛、提升生成质量,展示扩散模型 Tokenizer 演化方向。