「测试套件规模」共找到 2143 篇相关文章
王炸!模型越接越乱,2.9 万 Star OmniRoute 把 290+ 个 AI 供应商压成一个入口
现在接入AI工具麻烦,换模型要改配置,额度、接口等也有问题。OmniRoute是开源AI Gateway,将多家模型供应商统一到一个入口,支持290+ providers等,可解决接入混乱问题。
人才黑洞!UC伯克利系主任都加入A社了
UC伯克利EECS系主任Jelani Nelson暂离大学,加盟Anthropic预训练团队。他算法课播放量超2100万,研究聚焦大规模数据高效处理,这正是A社所需,此前他还在谷歌兼职。
阶跃开源JetSpec,大模型推测解码提速近10倍
随着Agent应用爆发,大模型推理效率成AI行业焦点。阶跃星辰联合多校团队开源JetSpec,该框架面向推测解码,在H100上把MATH - 500解码速度提升到9.64倍,突破了推测解码的扩展天花板。
OpenAI 和 Anthropic “杀”红了眼,谷歌成为最大受害者
6月AI人才市场,谷歌7天内损失四位技术元老,分别加入OpenAI和Anthropic。这引发外界关注,有人质疑谷歌AI处境。DeepMind CEO哈萨比斯回应称,判断AGI竞赛输赢不能只看短期,谷歌仍有优势。
刚刚,翁荔博客上新:谨慎对待Scaling Law
翁荔新作《谨慎对待 Scaling Law》上线,文章涵盖 Scaling Law 预测内容、计算最优分配原理等。介绍了早期对机器学习损失可预测性的研究,还对比了 Kaplan 等人与 Chinchilla 的 Scaling Law,分析了两者分歧原因。
开发者冲爆了!全球前十AI Lab无限免费,一周烧出3.12万亿Token
6月1日,全球模型榜单前十的Agnes AI无限期免费开放旗下核心全模态模型API,引发开发者热情。两周后周调用量达3.12万亿Token,本周还将升级,周五补齐语音全模态链路,开源社区也围绕其开展诸多项目。
为什么最有价值的AI讨论总发生在知乎?
AI成全民话题,但网上多是热点复述,真正有价值的理解和方法论沉淀在知乎。知乎答主toyama nao、德里克文、Jeff Tao陶建辉分别作为记录者、探索者和建设者,在AI领域深度探索,推动认知沉淀。
The Batch: 954 | Kimi K2.6 挑战开源权重模型领先者
Moonshot AI升级后的Kimi K2.6是1万亿参数的视觉 - 语言模型,专为代码生成设计,性能与Qwen3.6 Max Preview等相当,略逊顶级闭源模型。其功能多,幻觉率低,模型权重可免费下载。
13人干翻Transformer!新架构SSA算力暴减千倍,成本仅Opus 5%
一款基于SSA架构的AI模型SubQ横空出世,其上下文高达1200万Token,计算量比Transformer暴减1000倍,成本不到Claude Opus的5%。打造它的Subquadratic公司仅13人,产品发布后引发AI社区不同反应。
公里级场景也能稳住了,国产团队把长视频3D重建又往前推了一步
浙江大学、地平线机器人和之江实验室的新工作 Scal3R 要解决长视频 3D 重建问题。它借助 test - time training 技术,设计全局上下文模块和同步机制,提升长序列重建稳定性和精度,能处理超万帧几千米的场景。