「基准表发现」共找到 1842 篇相关文章
AIAA J | 西工大翟凯宇、李楠等:膨胀拐角影响下入射激波/边界层干扰的标度律分析
高超声速进气道肩部区域的激波 - 膨胀波 - 边界层干扰影响大,传统标度律有误差。本研究结合实验与理论,研究膨胀拐角影响下的入射激波/边界层干扰,提出改进标度律,还构建混合监测框架实现准确预测。
The Batch: 936 |Claude Code 内部揭秘
广受欢迎的编码智能体Claude Code近期版本意外暴露底层代码。Anthropic称是人为失误,未泄露用户数据。工程师分析发现其架构似小型专用操作系统,还揭示了潜在功能和未来规划。
刚刚,英伟达革了自己的命:智能体自主进化7天,干掉所有算子工程师、GPU专家
英伟达新研究AVO构建了新型进化变异算子,用自主编码智能体取代经典方法。智能体7天自主进化,优化MHA内核,性能超cuDNN和FlashAttention - 4,还能快速适配GQA,展现强大泛化能力。
「你是专家」竟成AI幻觉毒药?新论文一巴掌揭穿提示词最大骗局
最新论文证实,「让AI装专家」会可测量、持续地降低模型的准确率。研究发现,Persona Prompting的效果依赖多因素,专家人设提升的多是「对齐感」。为解决问题,研究人员发明PRISM算法。
用Diffusion构建「AI虚拟细胞」,14项指标霸榜!Mila唐建团队破解单细胞「破坏性」测序难题
Mila唐建团队发表PerturbDiff,跳出前人认知盲区,将“细胞群体的概率分布”视为随机变量。它引入数学工具建模,让MMD内生于体系,在多项基准测试霸榜,还提供应对数据稀缺的思路。
真钱买假模型?187篇论文被「套壳API」坑惨,准确率暴跌
CISPA论文指出,第三方影子API可能用廉价替代品替换前沿大模型。研究追踪17个服务,发现已被187篇论文引用。测试显示,影子API在多领域性能差,安全不可控,供应商有三种欺骗手段。
BeyondSWE:AI编程80分是真的强,还是考卷太简单?
前沿模型在SWE - bench Verified测试中得分超80%,但该测试像开卷填空。中国人民大学提出BeyondSWE重新设计评测,规模是前者18倍,模型得分全跌破45%。还提出SearchSWE框架,结果显示搜索与编码能力融合待提升。
智能流体力学青年学者论坛第30讲~33讲
智能流体力学青年学者论坛第30 - 33讲将于2026年3月6日举办,由中国空气动力学会智能流体力学专委会主办。报告涵盖迈向大语言模型时代的自动化智能CFD工作流等主题,多位学者将分享最新研究成果。
AI海啸将至,全人类还没准备好!Anthropic CEO警告
Anthropic CEO Dario Amodei从百度时就隐约发现Scaling Law,推动OpenAI接受。他不满OpenAI发展方向,离开创立Anthropic。他认为智能爆炸后影响巨大,要做对AI,还警告人类要重视AI风险。
13 vs 3,国产安全AI悄悄完成了对Claude的超越
Anthropic官方披露Claude Code Security定位3个典型0day漏洞,而安恒信息旗下恒脑安全智能体100%复现这3个漏洞,还额外挖出10个全新0day漏洞,展现出强大的AI自主发现能力。