「时间采样」共找到 425 篇相关文章
高盛怕了!Claude Mythos全球首个攻破企业网络,奥本海默时刻来了
英国AI安全研究所研究显示,Anthropic发布的Claude Mythos Preview模型在网络安全评估中表现惊人,能全自动、全自主完成企业网络攻击模拟。高盛为此加强网络防御,人类网络安全或进入奥本海默时刻。
OpenClaw危了?Claude Code迎来最激进升级:AI 开始直接操控电脑,正面挑战 OpenAI
北京时间昨日夜里,Anthropic 宣布对旗下 Claude Code 与 Claude Cowork 进行关键更新,AI 可直接操控电脑。同日 OpenClaw 也迎来重大更新,重构插件系统、升级模型等。二者更新引发关注,各有优劣。
用Spring AI Alibaba把MultiAgent实现从5天压到5小时
Spring AI和Spring AI Alibaba新版本支持Multi - agent编排。文章展示基于Spring AI Alibaba实现Multi - agent,从原理到实战,给出示例代码,解决手写框架问题,对比两种编排方式优劣,强调选对框架可提升开发效率。
大模型的第一性原理:(二)信号处理篇
本文从信号处理角度解读大模型原论文,探讨语义向量化原理,分析 Transformer 与 Granger 因果关系。指出大模型输入 Token 语义嵌入是将自然语言处理转化为信号处理问题,向量化与信号处理、信息论联系紧密。
拿着做数学题的 PRM 来评判 Agent 调用工具,基本是行不通的!
目前评估体系多为结果导向,在工具调用上缺乏像样的PRM基准。Arizona State University和Intuit AI Research研究者推出ToolPRMBench,指出用做数学题的PRM评判Agent调用工具行不通,还介绍了其构建方法、训练范式和实验结果。
摩尔线程天使投资人:对近期AI的四十个观察
摩尔线程天使投资人王捷整理关于AI经济四十个问题,涵盖模型发展、经济影响、就业冲击等方面,如Scaling Law收敛、AI扩散时间、数字层机制等,为探讨AI经济提供观察视角与分析框架。
用AI写PPT,没想到效果这么好啊
文章聚焦用 CodeBuddy 写 PPT,先指出写 PPT 的痛点,介绍 CodeBuddy Skills 解决方案,接着阐述安装、实战场景、使用技巧,深度剖析 PPT Skill 原理、架构等,最后说明优势与局限,助力摆脱 PPT 难题。
信息量爆炸!OpenAI内部路线图首次全曝光,首席科学家亲口承认:超级智能10年内到来
OpenAI宣布重组完成后,Sam Altman和首席科学家Jakub Pachocki直播公开内部路线图,称深度学习或10年内实现超级智能,还公布了AI研究目标与时间线,涉及产品、基建等多方面规划。
一个指令误导智能模型!北航等首创3D语义攻击框架,成功率暴涨119%
北京航空航天大学与中关村实验室团队提出全新框架InSUR,入选NeurIPS 2025。该框架可基于指令生成对抗样本,首次实现3D SemanticAE生成,从采样、建模、评估三方面突破,实验验证其有效性与可扩展性。
Temperature Scaling可大幅提高Test-Time Scaling瓶颈!
大型语言模型解决复杂推理问题时,测试时扩展(TTS)是提升性能的途径之一。但传统TTS依赖增加样本数量,性能提升有瓶颈。本文提出温度缩放新思路,实验表明其能大幅提升性能,还给出降低成本方法。