「可验证推理」共找到 6170 篇相关文章
第一个用物理做计算原语的大规模生成模型Un-0来了,或将AI能耗降低1000倍?
Unconventional AI 发布首个以物理为计算原语的大规模生成模型 Un-0,由‘模拟耦合振子系统’驱动。其目标是降低 AI 能耗,在 ImageNet 64×64 上 FID 达 6.74,质量接近部分主流传统图像生成方法刚发布时水平。
倒计时三周!2026 世界人工智能大会将于 7 月 17 日至 20 日在上海举行
6月17日,2026世界人工智能大会倒计时30天发布会举行,公布主题、生态矩阵等。大会7月17 - 20日在上海举办,设六大板块,有诸多活动和展示,还发布SAIL奖TOP30榜单,公布WAIC City Walk等信息。
《Loop Engineering橙皮书》发布!免费,开源
《Loop Engineering橙皮书》发布,免费开源。Loop Engineering概念由多人共同推动,它是在提示词、上下文、缰绳工程基础上更进一步。文中介绍了循环的动作、零件,Claude Code的相关命令,也指出新手实践的坑。
模型越强,人的判断力越值钱:微软CEO破解“AI替代”焦虑
微软CEO纳德拉长文探讨‘AI驱动的经济中企业的未来’,指出企业要构建AI学习闭环,让人力资本和AI能力叠加增长。还提出认知闭环概念,强调人的判断力在AI时代更有价值,给出构建学习系统的具体方法。
Marvis 实测:6 个 AI“牛马”扎根桌面之后
作者实测腾讯 Marvis,它能实现终端调度、多 Agent 协同、跨模态任务链执行等。虽在编码、审美等方面有不足,但定位安全实用,适合普通用户,体现 AI 助手从对话工具向执行系统转变。
解码加速15倍!EdgeRazor助推大模型在PC/移动端“狂飙”
大语言模型参数膨胀,端侧部署难,量化成主流轻量化方案。开源工具库EdgeRazor由南京大学和微软联合推出,采用MPQAD打破极低比特大语言模型“能力塌陷”,在性能、效率、易用性等方面表现出色,打通AI全生态链路。
从 Computer Use到 Datacenter Use:如何让 AI Agent 像调用函数一样驱动数据中心?
本文整理自 QCon 2026 北京站演讲,探讨如何让 AI Agent 驱动数据中心。指出 Agent 发展有 Multi - Agent 和 Datacenter Use 趋势,介绍 AKernel 基础设施,包括架构、技术支柱、部署方式等,还提及其实践落地与未来演进。
国产GPU组了个开源局,把SGLang等核心开发者都摇来了!
国产GPU玩家摩尔线程举办SGLang × MUSA Meetup,邀请众多开源圈开发者。活动探讨如何让国产GPU进入大模型推理主流开源工程链路,显示国产GPU竞争迈向生态坐标之争。
UI-TARS-desktop:字节跳动的原生GUI智能体,用自然语言控制电脑和浏览器
字节跳动开源的UI-TARS-desktop是原生桌面GUI智能体工具,基于UI-TARS和Seed-1.5-VL系列模型。能用自然语言操控电脑和浏览器,有本地和远程两种模式,支持多平台,还对比了同类工具。
一张4090就能爆改!面壁智能MiniCPM-V 4.6开源,1B多模态卷出新高度
今年是AI应用大规模落地年,参数小的端侧模型有特定场景性能优势。5月11日面壁智能开源MiniCPM-V 4.6,参数仅约1B,多模态能力超阿里、谷歌同类模型,还在多维度提升,站稳端侧多模态开源领域。