可验证计算」共找到 5021 篇相关文章

算法论文8

条条电路通罗马:大模型解释性的「唯一机制」能从一开始就不存在

长期以来,机制解释性领域默认模型对同一任务的能力对应唯一内部「电路」。但被ICML 2026接收的新论文指出,「唯一电路」能不存在,同一任务由多个结构不同但能力相当的电路完成。

机器之心
算法论文8

拒绝「降智、减配、乱收费」:面向LLM API的验证框架

大语言模型成AI应用基础设施,黑盒服务模式引发信任危机。研究者提出IMMACULATE审计框架,能在不暴露模型信息、仅1%额外开销下,验证黑盒LLM API执行完整性,检测违规行为,相关论文与代码已公开。

机器之心
产品应用8

阿里云Tair KVCache仿真分析:高精度的计算和缓存模拟设计与实现

阿里云Tair KVCache团队推出Tair - KVCache - HiSim,这是面向分布式多级KVCache管理的高保真LLM推理仿真分析工具。它能在通用CPU上高精度预测性能,支撑计算选型、存储规划和调度协同等决策,还介绍了其架构、组件、验证及性能评估等内容。

阿里云开发者
产品应用7

小哥硬核手搓AI桌宠!接入GPT-4o,听得懂人话还能互动,方案复现

国外小哥Matthieu Le Cauchois受皮克斯台灯机器人启发,手搓AI桌宠Shoggoth,接入GPT - 4o,能与人互动。它结构简单复现,采用低级和高级控制层,策略经仿真和真实环境验证有效。

量子位
算法论文8

仅保留35% Token,性能反超原模型!快手灵等用视觉信息引导音频压缩,推理时间直降42%

Omni - LLM计算浪费严重,快手灵等团队提出OmniSIFT框架。它利用音视频非对称依赖关系,通过时空联合剪枝压缩视频、视觉引导筛选音频Token,大幅减少Token数量,提升性能和推理效率。

量子位
产品应用7

自写驱动越狱!Gemini 3 Pro零败绩通关宝梦:效率碾压前代8倍「Agent进化太快了」

在全自动《宝梦 水晶版》对决中,Gemini 3 Pro击败Gemini 2.5 Pro,通关速度至少快2倍,前代或慢8倍。它还展现出诸多能力,如自写驱动绕过限制等,但也存在不验证假设等局限。

AI寒武纪
推荐文章8

投奔小扎,Jason Wei连发两篇博文公布“屠龙术”:一个公式看透AI,一条心法指引人生

OpenAI研究科学家Jason Wei被小扎挖走后连发两篇文章。一篇提出“验证者定律”,指出训练AI解决任务难易与验证性成正比;另一篇从强化学习悟到人生要走On - Policy路线,发挥自身优势。

AI寒武纪
开源动态7

能自动把PDF转换为填写表单的开源工具,实用落地。

CommonForms是能自动将PDF转换为填写表单的开源工具,通过检测文本框等自动添加交互字段。它基于YOLO11做目标检测,支持CLI和API使用,有多种功能特点,能高效处理转换。

开源AI项目落地
产品应用7

视频进入编辑时代:藏师傅教你视频版 Banana 灵 O1

灵发布大一统视频、图像生成和编辑工具 O1,支持在一个界面完成视频图片编辑生成。此次更新统一多模态视频大模型,支持多模态输入,有诸多新特性,还支持自由选择视频生成时长和风格转换等。

歸藏的AI工具箱
产品应用8

灵2.5 Turbo太凶残:30%成本暴降+效果飞跃,生成体操动作去参赛

快手推出灵2.5 Turbo视频生成模型,在力量感、滞空感和物理感知上进步明显。官方称其在文本响应、动态效果等维度效果提升,高品质模式成本降30%。不过,它在物理认知方面仍有欠缺。

量子位