可验证」共找到 4545 篇相关文章

算法论文8

攻克AI过度思考难题!美团新研究让通过“可验证”过程奖励激活LRM的高效推理

美团等机构研究团队针对LRM“过度思考”问题,提出可验证的过程奖励机制(VSRM)。它结合可验证奖励与步骤级奖励,为推理步骤分配奖励信号。实验显示其能降低输出长度并保持性能。

量子位
新闻资讯7

Axiom Math 对谈 SGLang:模型的下一步是可验证,结果层才是真正的护城河

在AGI Playground 2026圆桌论坛,Axiom Math联合创始人等探讨AI核心问题。提到AI进入生产环境,可验证或成瓶颈,还从长任务智能体、推理基建等多方面深入交流,如模型验证、基建优化等。

Founder Park
开源动态8

o3 Gemini 都翻车?首个可验证长链 GUI 数据集 VeriGUI 重磅开源,探索通用 Agent 能力边界

GUI 智能体发展遇瓶颈,现有数据集难评估其长时程规划能力。2077AI 开源基金会牵头构建的 VeriGUI 应运而生,有长链复杂性与子任务级可验证性特征,论文登 Hugging Face 月榜第三,还证明现有模型瓶颈。

AI科技评论
新闻资讯8

刚刚,谷歌重大突破!量子计算首次可验证,登《Nature》封面

谷歌宣布重大成果,全新量子回声算法在 Willow 芯片运行,解决原子相互作用问题比传统超级计算机快 13000 倍,结果可验证,相关研究登《Nature》封面,朝量子计算实用迈进一大步。

机器之心
新闻资讯8

谷歌量子计算重磅突破登上Nature:首次实现可验证量子优势,比最快超算快13000倍

谷歌量子AI团队宣布里程碑式算法突破,其Willow芯片运行“量子回声”算法,首次在硬件上实现可验证量子优势,执行特定任务比最快超算快13000倍,为多领域应用铺平道路。

AI寒武纪
新闻资讯7

传奇黑客首次造出“透明芯片”,从硬件到代码全部公开可验证

8月初第34届Defcon黑客大会,主办方发放美籍华裔黑客黄欣国设计的徽章,核心是开源微控制器Baochip - 1x。该芯片从设计到制造全开放可验证,用红外原位检测,还集成硬件加固手段,安全性能对标商用元件。

DeepTech深科技
新闻资讯7

别再问什么工作被AI取代!Karpathy直指本质:你的工作「可验证」吗?

前特斯拉AI负责人Andrej Karpathy提出,软件1.0自动化能指定的任务,软件2.0自动化能验证的任务。判断任务能否被AI接管,关键看是否满足重置、高效试错、自动奖励三条准则。

新智元
算法论文8

CHI 2026 Best Paper|社会模拟迈入控、量化时代:为AI Agent加上「认知滑条」

UCSD团队在CHI 2026 Best Paper论文CoBRA中提出量化、可验证复现的Agent控制框架。它将经典社会科学实验转化为校准环境,使Agent行为控,标志着AI社会模拟走向实验科学范式。

机器之心
新闻资讯7

南科大教授余沛源创业做AI+材料:真正难的不是生成,而是验证

南科大教授余沛源创业成立三向纪元,构建可验证材料模型。他认为AI+材料研发难在验证,当下是产业化窗口期,中国有优势,初创企业与大厂各有优劣,公司有独特技术与商业模式。

DeepTech深科技
产品应用8

Strix AI驱动的漏洞动态验证能力分析

传统SAST工具只能发现‘能有问题的代码’,无法确认漏洞是否被利用,导致高误报率。Strix采用‘静态分析 + 动态验证’的混合模式,先定位疑点,再对漏洞进行真实攻击验证,显著降低误报率。

AI与安全
上一页1 / 455下一页