下架产品」共找到 1211 篇相关文章

产品应用7

在 RDS PostgreSQL 中实现 RaBitQ 量化

本文介绍在阿里云 RDS PostgreSQL 上,pgvector 能力进一步增强,引入 RaBitQ 量化提升其在大规模向量场景的表现。分析了 pgvector 面临的挑战,阐述 RaBitQ 原理、优势,给出性能测试结果及快速上手的 SQL 操作。

阿里云开发者
产品应用8

GPU利用率不到15%,AI业最大的浪费正在被这家公司改写|甲子光年

AI业发展中算力成本高、利用率低问题凸显。趋动科技押注‘软件定义GPU’,试图把独占GPU变为共享算力池,其品使客户GPU利用率平均提升约4倍,已服务超200家头部客户。

甲子光年
算法论文8

告别「想完再做」卡顿!清华StreamingVLA让VLA边想边行动,提速2.4倍

视觉 - 语言 - 动作(VLA)模型“观测 - 生成 - 执行”串行模式致交互卡顿,清华与联想合作提出StreamingVLA框,引入两项技术实现并行处理,在测试中显著提升效率和流畅度,为VLA模型部署提供新方案。

机器之心
算法论文8

分享2篇最新Harness论文,一篇谷歌,一篇微软

在LLM Agent迅速发展的当,如何为其设计合适的Harness成关键问题。本文分享微软M⋆和谷歌AutoHarness两篇论文,分别从记忆系统和动作约束维度提出自动化的Harness进化方法,并介绍了实验结果。

PaperAgent
开源动态8

Google开源黑科技!不用训练的时间序列预测模型,17.9K Star 疯狂追捧!

Google Research团队开源的TimesFM时间序列预测模型获17.9K Star。它零训练、开箱即用,基于1000亿时间点预训练,涵盖多场景数据,还能给出置信区间,已集成到Google多个品。

开源星探
开源动态8

9.7K Star 把 AI 编码的 token 消耗砍了 16 倍

当前AI编码工具默认读取整个项目文件,token消耗高。code-review-graph项目用Tree-sitter解析代码库成图,追踪改动“爆炸半径”,平均省8.2倍token,技术轻量,还能做社区检测。它揭示AI编码瓶颈在信息输入质量。

CourseAI
新闻资讯7

Meta员工空转AI只为浪费token!烧的多挣的多,日均消耗2万亿

Meta内部在首席AI官亚历山大王推动,员工为抢夺虚荣头衔展开“Token竞技”,日均消耗两万亿Token。这源于扎克伯格重写代码库要求,首席技术官支持资源投入。新模型将半开源,嵌入社交业务。

量子位
算法论文8

拒绝「降智、减配、乱收费」:面向LLM API的可信验证框

大语言模型成AI应用基础设施,黑盒服务模式引发信任危机。研究者提出IMMACULATE审计框,能在不暴露模型信息、仅1%额外开销,验证黑盒LLM API执行完整性,检测违规行为,相关论文与代码已公开。

机器之心
新闻资讯7

哈佛新研究:过度使用AI会“烧脑”,14%用户出现认知过载

哈佛研究证实过度使用AI会“烧脑”,是认知降维打击的压力过载。调查显示14%用户出现认知过载症状,AI工具过多还会增加认知切换成本。研究指出企业需重新设计工作方式,实现人机平衡。

量子位
算法论文8

ICLR-26腾讯混元:Agent是强大的,但用户是狂野的

现有LLM工具使用基准测试场景理想化,忽视真实用户行为复杂性。腾讯提出WildToolBench,基于真实用户行为构建测试集,对58个模型评估,发现模型准确率低,揭示LLM在真实场景能力缺口,为模型优化指明方向。

PaperAgent