token 接受率」共找到 1019 篇相关文章

新闻资讯7

深度揭秘OpenAI如何让GPT-5「技术性」超越Claude:悄悄跳过最难的23道题

OpenAI发布会上称GPT-5代码能力全球第一,其在SWE-bench Verified基准获74.9%通过,略高于Claude Opus 4.1的74.5%。但OpenAI未做23道难题,若计入,GPT-5实际通过或低于Claude。

新智元
算法论文8

突破一亿Token极限:EverMind提出MSA架构,实现大模型高效端到端长时记忆

机器之心发布文章介绍,大模型长期记忆能力受限于上下文长度。《MSA: Memory Sparse Attention for Efficient End-to-End Memory Model Scaling to 100M Tokens》提出MSA架构,突破扩展性、精度和效的不可能三角,实现100M长度的大模型长时记忆框架。

机器之心
算法论文8

更少的token生成更好的图!香港大学联合阶跃星辰等让AI绘画真正理解了再画

香港大学、阶跃星辰等用VFMTok新方法,让图像生成模型借用顶级视觉AI的眼睛看世界,实现更快、高质量图像生成,且无需复杂引导技巧。它改变图像理解方式,将像素死记硬背转为语义理解。

AIGC开放社区
算法论文8

晶圆级芯片和存算一体结合:中科院提出15万tokens/s晶圆级芯片方案丨ASPLOS'26

当前大模型发展对计算硬件需求增长,数据搬运成隐性开销。中科院团队成果Ouroboros实现晶圆级芯片,解决数据搬运问题,虽面临挑战,但性能与能效表现显著,验证了“存算一体+晶圆级集成”路线可行性。

量子位
算法论文8

杜克大学、Zoom推出LiveMCP‑101:GPT‑5表现最佳但未破60%,闭源模型Token对数规律引关注

杜克大学与Zoom研究者推出LiveMCP - 101,这是针对真实动态环境的MCP - enabled Agent评测基准。含101个任务,实验显示先进模型成功低于60%,研究为提升Agent能力提供改进方向。

机器之心
产品应用7

真·博士水平!GPT-5首次给出第四矩定理显式收敛,数学教授只点拨了一下

在数学教授引导下,GPT - 5首次将定性的第四矩定理扩展为带有显式收敛的定量形式,明确了收敛速。研究人员还引导其将结果推广到泊松情形,作者起初想将其列为论文共同作者但被 arXiv 政策禁止。

量子位
算法论文8

只看图片就能学会压缩Token!浙大&阿里新框架多轮VQA压缩90%,精度不掉|CVPR 2026

多轮视觉问答成LVLM推理效“照妖镜”,现有压缩方法在多轮场景翻车。浙大宋明黎教授团队与阿里联合提出MetaCompress框架,可根据图像生成最优压缩映射,实验验证其效果优,能平衡压缩与精度。

量子位
算法论文8

AI修Bug新SOTA:SWE-Bench Lite60.33%修复,像人一样能积累经验,中科院软件所出品

ExpeRepair是中科院软件所团队推出的仓库级缺陷修复系统,模拟人类认知的情景和语义两种记忆模式,能积累经验。在SWE - Bench Lite评测中,其Claude - 4+o4 - mini组合修复达60.3%居首。

量子位
产品应用7

王兴兴亲测后点赞!这家AI公司提前半年把“龙虾”能力带上车,还管住了Token黑洞

宇树科技王兴兴体验宝马新世代 i3 智能座舱后称赞,其核心技术来自斑马智能“元神 AI”。斑马智能发布“元神 AI 汽车机器人大脑”等,对“元神 AI”升级,明确交流和办事方向,还管控 Token 等挑战。

AI前线
新闻资讯7

AI Coding 生死局:Spec 正在蚕食人类编码,Agent 造轮子拖垮效Token成本失控后上下文工程成胜负手

本文为《2025 年度盘点与趋势洞察》系列之一,聚焦 AI Coding 在程序员群体的演进与落地。探讨了 Spec 驱动开发、Agent 崛起、Token 成本等问题,指出上下文工程是 AI Coding 成败关键。

InfoQ