验证不对称性」共找到 2064 篇相关文章

7

IMO怒斥OpenAI自封夺金,“91位评委均未参与评分”,网友:炒作无下限

OpenAI宣称新模型获IMO金牌到24小时剧情反转,多位官方人士和大佬指其做法“粗鲁且恰当”。其“金牌”成绩或站住脚,未与官方合作,无评委参与评估。此事引发学术道德和商业炒作争论。

量子位
新闻资讯8

OpenClaw 走红背后:Agent、AI Coding 与团队协作的新问题

InfoQ《极客有约》X QCon 直播栏目邀请专家探讨 OpenClaw 爆火、使用体验等问题。指出它并非低门槛产品,AI Coding 核心问题是稳定与可控,还讨论了团队落地方式及未来 AI Coding 可能的拐点。

AI前线
新闻资讯8

程序员许写代码!OpenAI硬核实验:3人指挥AI,5个月造出百万行

OpenAI官博曝光内部实验,3人团队利用Codex智能体5个月造出百万行代码产品,人类写代码,精力放于规划规则。此实验颠覆软件工程定义,宣告手工代码时代终结,也重塑程序员岗位。

新智元
推荐文章7

什么时候该微调:比“怎么微调”更重要的一件事

文章指出微调失败常因一开始就该调。强调微调解决行为问题而非能力问题,还列举了该微调的五种场景,如知识接入问题、Prompt没写好等,建议先验证思路,明确目标再行动。

机器学习AI算法工程
新闻资讯7

AI泡沫后只剩这两类公司杀出重围!昆仑万维CEO方汉:明年唯一技术赛点在Agent

昆仑万维CEO方汉认为,AI泡沫是必经阶段,产品价值落地成主线,生态是系统工程。今年两类公司突围,四类公司落后。2026年技术赛点是Agent自动化‘可验证过程’。

InfoQ
推荐文章7

对科技圈,小红书是个「新绿洲」

作者认为小红书正成为科技圈的「新绿洲」,这里有独特的「人间视角」。科技内容消费模式似「人间夜市」,博主和开发者圈点翻译技术概念。创业者可低成本验证想法,与用户形成「养成系」共生关系。

量子位
7

错信AI幻觉,一男子用溴化钠替代食用盐,真给自己吃出幻觉了

美国一位60岁男子错信ChatGPT建议,用溴化钠替代食用盐,致体内溴含量严重超标,出现妄想症等溴中毒症状。医生研究发现,旧版ChatGPT未提供健康警告,而GPT - 5建议用溴化钠替代食盐。

量子位
算法论文8

精准调控大模型生成与推理!浙大&腾讯新方法尝试为其注入“行为定向剂”

ACL 2025中选论文里,浙大与腾讯联合团队提出STA方法,深入模型内部分析神经元激活模式,干预关键神经元,抑制有害行为、保留通用性能,还在多模型实验验证效果,并将部分方法开源。

量子位
8

Anthropic的疯狂一周:每天一个新产品,我已经跟上了

4月4 - 9日,Anthropic动作断,先封杀第三方Agent用Claude订阅额度,又发布Claude Mythos Preview、Claude Managed Agents和Advisor Tool。其Agent产品线分三层,还展现“发布”策略,背后是控制生态的商业考量。

花叔
算法论文8

端到端智驾新SOTA | KnowVal:懂法律道德、有价值观的智能驾驶系统

北京大学王勇涛团队提出新型自动驾驶系统 KnowVal,通过感知与知识检索模块协同实现视觉 - 语言推理。它构建驾驶知识图谱,有价值模型用于轨迹规划,实验在多基准测试表现佳,还通过定性分析验证效果。

机器之心