「可解释性研究」共找到 5527 篇相关文章
AI穿越战争迷雾,72%的准确率化身中东冲突预言家
阿联酋和美国研究人员用中东冲突测试AI推理表现,发现其能看透利益博弈、预判战局演变。AI擅沿客观限制推演,在经济领域敏锐,政治领域较难,整体预测准确率达72%。
Rokid火得太晚了
消费电子市场中AI眼镜迎曙光,乐奇Rokid成AI+AR品类全球销冠。它通过双目衍射光波导和双芯片架构解决轻量化与续航难题,还以开放生态脱颖而出,其判断未来眼镜将成交互主体。
性能飙升42%!人大&字节开源10万级 SWE数据集 Scale-SWE
近期,人大和字节开源10万级软件工程数据集Scale - SWE,用首创工作流从GitHub构建真实数据。基于此微调的Qwen3 - 30A3B - Instruct模型测试表现佳,其数据相比合成数据优势明显。
Skill制作和使用秘诀!Claude Code工程师的官方宝藏经验
Anthropic工程师发布《Claude Code的经验教训:我们如何使用Skill》教程,介绍Skill是智能体开放标准及在Claude Code的应用,分享制作技巧、类型,还提及分发、管理、组合和衡量方法。
Claude Code 新增 /btw 功能:让你在 AI 干活时「插嘴」提问
Anthropic工程师Thariq宣布Claude Code新增`/btw`命令,支持在其执行任务时开启「旁路对话」。该功能不打断任务、不污染主对话历史,能解决提问痛点,反映AI编码工具走向「持续协作」趋势。
Karpathy Vibe Coding整新活:Agent版「GitHub」问世
最近,Karpathy 玩 Vibe Coding 上瘾,上周末开源项目让 AI Agent 自主实验,10 多小时前又开源「agenthub」,这是 Agent - first 协作平台,可理解为极简版 GitHub,还能用于构建自治学术体系。
Claude推出多智能体代码审查系统:Anthropic内部同款,接管PR深度抓Bug
Anthropic为Claude Code引入代码审查系统,复刻内部审查机制,调度多智能体揪深层Bug。该功能面向团队和企业版用户预览,审查更彻底,虽成本高但有效提升审查质量,还能自定义规则、管控成本。
黑科技来了!无需联网,WIFI信号让你无处遁形!
WiFi DensePose利用WiFi信号,无需联网、摄像头和穿戴设备,通过分析信道状态信息扰动,实现人体姿态估计、生命体征监测和存在检测。它有多种特性,适用于医疗、零售、工业等多场景。
Cursor:AI编程「第三时代」来了
近日,Cursor CEO Michael Truell 称 AI 编程迈入「第三时代」,特征是 Agent 能在少人工干预下完成大规模任务。Cursor 核心转变,内部超 1/3 代码提交由云端智能体创建,团队预计多数开发工作将由其完成。
ICLR 2026|在「想象」中进化的机器人:港科大×字节跳动Seed提出WMPO,在世界模型中进行VLA强化学习
香港科技大学 PEI - Lab 与字节跳动 Seed 团队提出 WMPO 新范式,可让具身智能在‘想象中训练’,解决传统 VLA 训练瓶颈,目前论文、代码与模型均已开源。