学术信任」共找到 286 篇相关文章

新闻资讯7

通往 AGI 之路的苦涩教训

Google DeepMind CEO 预测 5 到 10 年有 50% 概率实现 AGI。本期《万有引力》直播对话将探讨通往 AGI 之路的教训。6 月 27 日,唐小引将对话刘嘉,从其学术轨迹解答 AI 路上的教训,还会剖析技术路径。

AI科技大本营
算法论文8

EMNLP 2026高分论文MathDebugger:当合成数据涌入训练集,如何为数学题做体检?

随着合成数据增多,模型需判断数学数据题目能否被信任。北大DCAI团队提出MathDebugger质检BenchMark,覆盖问答两端,评测主流LLM和PRM。还探究能否判断正误、分类错误、修复数据,证明错误标签可作监督信号。

InfoQ
新闻资讯7

马斯克宣判代码死刑!AI直出二进制,行业教父集体回怼

马斯克在X上称代码正变成下一个汇编,要让AI直接生成二进制,摒弃“源代码”。此言论引发争议,UML之父、《代码整洁之道》作者等教父级人物纷纷回怼,而现实中AI生成代码已成趋势。

新智元
新闻资讯7

AI浏览器这百亿大蛋糕,谁也没吃到?

2023年大模型火时,AI浏览器被视为百亿创业项目,曾诞生创业热潮。但三年来,它未能让用户换掉传统浏览器,经历从加AI助手到与Agent结合阶段,面临权限、信任等问题,未获主流认可。

鲸选AI
新闻资讯8

哈佛物理教授疯了:我让AI写论文,结果两周干完博士一年工作!已发顶刊

哈佛物理学教授Matthew Schwartz指导Claude 4.5,两周产出顶刊级量子场论论文,人类博士生则需一两年。实验中AI展现能力也暴露问题,教授总结其优缺点及应对心法,还探讨人类科研人员未来。

新智元
算法论文8

拒绝「降智、减配、乱收费」:面向LLM API的可信验证框架

大语言模型成AI应用基础设施,黑盒服务模式引发信任危机。研究者提出IMMACULATE审计框架,能在不暴露模型信息、仅1%额外开销下,验证黑盒LLM API执行完整性,检测违规行为,相关论文与代码已公开。

机器之心
新闻资讯7

ICLR 2026还会好吗?300篇投稿50篇含幻觉,引用example.com竟也能过审

GPTZero扫描300篇ICLR 2026投稿论文,发现50篇含引用幻觉,如用example.com作引用,且经同行评审也未识别。学术会议和期刊在AI重压下不堪重负,GPTZero幻觉检测工具或助同行评审。

机器之心
新闻资讯7

薛定谔亲外孙创业量子计算,老黄早早就成了股东

PsiQuantum由薛定谔外孙参与创办,获10亿美元巨额融资,欲2028年造百万比特级量子计算机。其量子比特基于光子,有生产优势,不过纠错能力待验证。公司团队学术背景强,项目多为政府大单。

量子位
新闻资讯8

西湖大学打造了一个AI科学家,突破人类SOTA,还能自己发论文

西湖大学文本智能实验室推出能自主探索的AI科学家DeepScientist,两周完成人类三年科研量。它在三个前沿AI任务刷新SOTA纪录,还能写论文。文中介绍其科研历史、工作方式、成果及面临的伦理问题。

AIGC开放社区
推荐文章8

产品经理必读:AI智能体架构指南——为什么能力强不等于用户爱用?

文章为产品经理打造AI智能体架构指南,以客服智能体为例,阐述四个架构层面决策,分析主流架构方法优劣,还指出构建智能体要注重信任策略,第二部分将探讨自主性决策和治理问题。

宝玉AI