「验证不对称性」共找到 2064 篇相关文章
国家队出手!AI智能体要发「身份证」,首个互联国标将落地
2026年5月8日,多部门联合发布《实施意见》,推动智能体应用,加强AIP等关键国标应用。全国信标委编制的AIP系列国标将公布,现启动AIP协议应用验证先锋计划,招募伙伴开展工作并明确权益义务。
OPPO AI重磅发布:深度研究智能体,离“真正好用”还有多远?我们给大模型做了一次全身体检
2025年,Deep Research成AI热点,OPPO AI Agent Team对大模型评测。发布论文,开源评测基准FINDER和失败分类体系DEFT,揭示AI“装懂”“缺乏韧性”问题,还分析模型表现并给出发展建议。
Github斩获1.8K 星!!再见了按键精灵,Windows-MCP开源了!
今天介绍超酷开源项目Windows - MCP,它让AI与Windows系统互动,支持Win7到Win11。功能强大,不挑大模型,工具全、轻量开源、扩展性强。还给出安装步骤,不过使用时要谨慎。
智能体并非越多越好,45%准确率成关键拐点
Google研究《Towards a Science of Scaling Agent Systems》验证“智能体并非越多越好”。在GPT等上实验发现,单个智能体准确率超45%,增加数量会损性能,还揭示工具税、错误螺旋等问题,给出预测公式。
扩散模型自引导新范式:直接交换token就能变强! | CVPR‘26 Oral
上海交大和vivo研究者提出自交换引导(SSG),不依赖文本条件、不加噪声、不改模型,只交换token特征。在多数据集实验中,SSG表现超现有方法。不过,其缺理论支撑、计算开销大。
29个月增长100倍:一个AI 2.0公司应该怎么建?HeyGen的取胜的秘密
AI视频生成公司HeyGen在29个月内ARR从100万美元增长到超1亿美元。创始人Joshua Xu公开取胜秘密,即独特运营模式‘The HeyGen Way’,包括拥抱变化、匹配节奏、最小化快速验证迭代等理念。
陶哲轩最新演讲:AI 不是来抢数学家蛋糕的,是来把蛋糕做大的
陶哲轩在 SAIR 基金会活动演讲指出,数学领域工作方式正被新技术撬动。数学保守、协作难,而形式验证是关键。他主导项目用三个月解决 2200 万代数题,还探讨了 AI 在数学中的应用,认为它应做大蛋糕。
WaveSpeedAI 成泽毅:AI Infra 本来就是一门能挣钱的生意
WaveSpeedAI成泽毅本在大厂做Infra,后创业。他先在社区验证技术价值,创业首日就定全球化策略。WaveSpeedAI团队小而灵活,用利他思维合作,在视频生成领域降成本,验证了推理基建有市场。
创始人强塞AI代码,致开源社区分裂!核心开发集体出走:“你这种强权压制,让人恶心!”
近期,GZDoom 背后的开源社区因创始人兼维护者 Graf Zahl 在代码库中加入未经测试的 AI 生成代码而分裂,抗议者创建了分支 UZDoom。Graf 称只是用 AI 生成样板代码,不影响核心功能,但社区成员认为开源项目不该用 AI 工具。
当 AI 下场炒 A 股,「推理」成了新的直觉
海外“AI Trading Battle”实验中,不同大模型交易表现差异大。港科大等团队提出RETuning方法,基于A股数据集验证,显著提升大模型金融预测准确率、推理可解释性,是综合改进方案,但有算力等局限。