「科学发现缩放定律」共找到 1277 篇相关文章
Ben Thompson:Agent会下单之后,Amazon 和 Shopify 活得更好了
大家以为AI会重构电商,可ChatGPT的checkout功能未成功,Shopify、Amazon等电商平台仍活得好。分析师Michael Morton指出,AI改变产品发现入口,但难抹平支付等环节,品牌官网因AI获更多流量。
「世界理解」维度看AI视频生成:Veo3和Sora2水平如何?新基准来了
近年来,T2V模型进展显著,Sora2爆火引发对其是否为‘世界模型’的探讨。传统基准无法系统衡量模型对事件因果等的理解,中山大学等团队提出新评测框架VideoVerse,评测主流模型并发现开源与闭源模型差距及各模型缺陷。
挖漏洞何必Mythos,国产智能体早跑通了
手握Mythos的Anthropic因安全问题将其锁起,引发安全圈对AI规模化挖漏洞的思考。360集团自主研发的漏洞挖掘智能体公开披露两项重大发现,影响超10亿用户,还展示了其技术路线、优势及战略意义。
C3仓库AI代码门禁通用实践:基于Qwen3-Coder+RAG的代码评审
本文介绍C3仓库基于Qwen3 - Coder+RAG的代码评审实践,在CI流水线监听代码修改触发AI评审,可发现逻辑风险、拦截高危缺陷。该实践能提升评审效率与质量,可复用于代码门禁平台或辅助编程工具,当前仍在持续优化。
对话「哈萨比斯传」作者:“他不喜欢奥特曼”
《哈萨比斯:谷歌AI之脑》作者塞巴斯蒂安·马拉比与量子位深度对谈,探讨书中细节与幕后故事。哈萨比斯不喜欢奥特曼,追求知识科学,与奥特曼价值观不同,书中也谈及他成长、错误及面临的困境。
大模型刷数学题竟有害?CMU评估20+模型指出训练陷阱
CMU团队评估20多个大模型,发现只有强化学习(RL)训练的模型能将数学推理技能广泛迁移到其他任务,监督微调(SFT)训练的模型迁移有限甚至无迁移。研究还探索差异原因,表明RL微调更具优势。
关于现代GPU体系结构内存一致性(Memory Consistency)模型的一些猜想(二)——同步性能
文章聚焦GPU应用层面,通过实验对比不同同步代码实现的性能。在H20 GPU上测试,发现scope越小同步性能越好,内存屏障开销随scope增大而增加,还介绍非PTX及官方推荐实现方式并给出性能对比。
密室逃脱成AI新考场,通关率不足50%,暴露空间推理短板丨清华ICCV25
清华大学团队受密室逃脱游戏启发,提出EscapeCraft:一个3D密室逃脱环境,用于评估多模态大模型在视觉环境中完成复杂任务推理的能力。该论文已入选ICCV 2025。研究评测了多个热门模型,发现它们在推理和探索行为方面存在诸多问题。
谈一谈TP推理场景下MoE Group GEMM的优化思路
作者在使用H20测试SGLang CUTLASS MoE时,发现其在中小Batch Size场景下性能不佳。为此设计Expert Specialization方案,启动多个不同配置Kernel,依Expert计算特性选合适的。还介绍了该方案在H20和Hx00上的实现细节及性能测试结果。
奥特曼曝惊世预言:2035年GPT-8治愈癌症!人类将为算力爆发三战
新智元报道,GPT - 5发布引热议,奥特曼在访谈中金句不断。他预言2027年AI有重大科学突破,2035年GPT - 8或治愈癌症,2050年人类可能为AGI算力争夺爆发三战,还谈及AI发展瓶颈、对人类影响等。