测试时扩展技术」共找到 4663 篇相关文章

开源动态8

阶跃开源JetSpec,大模型推测解码提速近10倍

随着Agent应用爆发,大模型推理效率成AI行业焦点。阶跃星辰联合多校团队开源JetSpec,该框架面向推测解码,在H100上把MATH - 500解码速度提升到9.64倍,突破了推测解码的扩展天花板。

AIGC开放社区
产品应用7

谷歌把电脑操作能力塞进Gemini 3.5 Flash!自己看屏幕狂点70轮

谷歌将电脑操作能力Computer Use内置进Gemini 3.5 Flash,该AI能通过看屏幕操作电脑,可执行点击、打字等动作。其覆盖网页、桌面软件和移动端,还加入安全约束机制,在基准测试中表现良好。

量子位
新闻资讯7

去往 Capital One 的俞栋,曾是 Hinton 的「救命恩人」

近日原腾讯AI Lab副主任俞栋加入Capital One。此前他和邓力曾在微软为Geoffrey Hinton雪中送炭,挽救深度学习研究。如今邓力、俞栋等技术大佬纷纷投身金融公司,或是因薪资、挑战和资源等因素。

AI科技评论
产品应用8

3B激活参数,干翻GPT-5.4和Opus4.6,商汤绝影把龙虾塞进了车里

商汤绝影发布端侧多模态大模型Sage,32B总参数、3B激活参数,在PinchBench评测超Claude Opus4.6等。自研SCOUT和ERL技术助力,从多维度领先同量级端侧模型,为座舱智能体提供支撑。

量子位
新闻资讯7

医疗大模型的中国战局:谁在打,打到哪了

中国医药AI赛道已有三家公司上市,是大模型赛道唯一跑通商业化闭环的方向。介绍了各梯队企业情况,分析百川智能技术领先但商业化待证明,还对2026年医药AI赛道给出关键判断。

AI Reading Hub
新闻资讯8

Karpathy 亲手终结了RAG的草莽时代

Andrej Karpathy分享“LLM Wiki”工作流,将多数Token用于构建“可演化知识库”。此方法不依赖复杂架构,在中等规模数据集上展现出强大能力,引发“LLM Wiki杀死RAG”的讨论,在技术社区和企业级市场反响热烈。

InfoQ
算法论文8

复旦北大联合美团LongCat提出TDAR:用“粗思考,细求证”破解Block Diffusion的速度精度悖论

复旦大学、北京大学联合美团LongCat提出Block Diffusion推理模型Test-Time Scaling新框架TDAR,引入‘粗思考,细求证’范式与有界自适应置信度解码,打破速度与精度零和博弈,在多基准测试表现出色。

机器之心
推荐文章7

通过架构建议流程实现架构决策的去中心化

Andrew Harmel - Law 在 Goto 大会提出架构建议流程,认为传统架构实践不可扩展,架构需去中心化。该流程让任何人可做决策,只需向受影响者和专家寻求建议,还提到失效模式及实践转变。

InfoQ
新闻资讯7

蚂蚁投了一家上海具身智能公司

马年新春,蚂蚁集团领投上海具身智能创业公司大晓机器人,这是蚂蚁2026年首笔具身智能投资。大晓机器人刚完成天使轮融资,资金用于技术迭代与产品落地,其核心团队实力强劲。

量子位
新闻资讯7

马斯克首席AI脑与莱姆病抗争!曾师从丘成桐,杨格宣布辞职

马斯克xAI核心架构师、联创之一杨格宣布离职,转任非正式顾问。他长期与莱姆病斗争,打算康复后复出。杨格是数学天才,师从丘成桐,是Tensor Programs理论之父,其技术为xAI节省大量算力成本。

新智元