「机制可解释性」共找到 4710 篇相关文章
OpenAI即将发布:开源模型和浏览器
OpenAI将发布AI驱动的网页浏览器挑战谷歌Chrome,或集成代理Operator实现智能网络体验。还准备下周四发布类似o3 mini的开源模型,不再是微软Azure独家。谷歌也可能很快发布Gemini 3。
告别盲选LLM!ICML 2025新研究解释大模型选择的「玄学」
弗吉尼亚理工大学研究团队提出 LensLLM 框架,基于 PAC - 贝叶斯泛化界限揭示 LLM 微调性能“双相演进”,可精准预测微调性能、大幅降低计算成本,为 LLM 选型提供新工具。
2025.7.4上午 | 视觉智能驱动的多模态对齐与推理的近期系列工作分享 - 复旦博士生王思尹
本次分享由复旦博士生王思尹围绕‘视觉智能驱动的多模态对齐与推理’展开,介绍多模态大模型探索研究,涉及跨模态组合语义理解、视觉参与推理及基于视觉建模世界完成行动等内容。
终于开源升级OmniGen2,统一多模态图像生成模型,真的惊艳。
OmniGen2是强大的开源统一多模态图像生成模型,针对文本和图像模态构建独立解码路径,运用未共享参数。新架构提升处理效率和质量,在图像编辑等任务表现出色,还有多技术特点。
EchoLeak-首个导致 M365 Copilot 数据泄露的零点击 AI 漏洞
Aim Security发现“EchoLeak”漏洞,利用RAG Copilot设计缺陷,攻击者无需特定用户行为就能窃取M365 Copilot上下文数据。文章详述攻击流程、利用方法,此研究在AI安全领域有多项突破。
Andrej Karpathy 辣评Veo 3:视频生成将直接优化人类的注意力,TikTok只是弟弟
Andrej Karpathy发文对Google的Veo 3视频生成模型发表见解,指出视频生成技术进步带来四个关键转变,认为视频将成AI与人类交流绝佳界面,也引发众人对其利弊的讨论。
13.8K star!!6G显存就能跑的AI视频神器,支持1分钟生成,这么6?!
现在AI视频生成领域仍面临高算力需求挑战,斯坦福大学研究团队推出`FramePack`项目,降低了本地AI视频创作硬件门槛,有低硬件需求、高效生成速度等特色,操作也简单。
Gartner:到2029年,50%的云计算将用于AI工作负载
全球著名咨询调查机构Gartner公布未来4年影响云计算增长的几大趋势,如对云不满、AI/机器学习需求增加等,还给出各趋势的预测情况及应对建议。
FaceAge登上「柳叶刀」!AI一张照片看穿你的真实年龄
科学家开发AI工具「FaceAge」,登上《柳叶刀数字健康》。它能通过人脸照片预测癌症患者生物年龄辅助治疗。研究显示,脸显老的患者治疗效果差。不过,它存在训练数据局限,离临床应用还有距离。
所有AI工具共享持久私有记忆,OpenMemory MCP杀疯了~
本文介绍实用的MCP Server - OpenMemory MCP,它能为AI提供持久记忆、跨平台和跨会话功能,数据私有,隐私有保障。还演示了本地化部署步骤,且官方封装成MCP降低了使用门槛。