「推理可解释性」共找到 5712 篇相关文章
MCP可能并不必须!
在大家将MCP奉为Agent工具协议标准时,Mario Zechner博文提出不同观点,认为很多情况下无需MCP。作者结合自身经验认同此观点,分析了MCP现实困境,介绍简单替代方案及优势。
藏师傅 Kimi K2 Thinking 首测!教你用 Kimi 编程全家桶
本文首发测评藏师傅 Kimi K2 Thinking,介绍 Kimi 编程全家桶。K2 Thinking 有 Agent 化等多方面升级,还推出 Kimi CLI 工具与 KFC 套餐。作者展示全家桶使用方法并多维度测试,肯定其表现,赞 Kimi 战略清醒务实有远见。
EMNLP 2025 Oral|检索增强 + 两阶段微调:剑桥提出有害内容检测大模型RA-HMD,性能SOTA
多模态有害信息检测是网络内容安全治理的重难点,多模态模型在有害内容检测上有瓶颈。剑桥大学团队提出RA - HMD框架,通过两阶段微调与结构增强,结合检索增强,提升检测性能,被EMNLP 2025接收。
算法与我们:谁在驱动极化?
荷兰阿姆斯特丹大学论文《我们能修复社交媒体吗?》借助AI模拟无算法社交平台,发现三大乱象迅速复现,干预收效甚微。指出问题根源或在社交底层架构,用户可改变分享模式。
Gemini 的 PPT 生成:使用技巧及模板提示词
Gemini APP 上线 PPT 生成能力,可通过提示词精细控制,还能与谷歌产品打通。文章介绍其使用方法,如开启 Canvas 模式、利用搜索填充内容等,还分享百搭 PPT 风格提示词。
马斯克造星链,劈柴造算链!英伟达卷到宇宙,谷歌也要上天
谷歌官宣「Project Suncatcher」,要在太空建设可扩展的AI计算系统,预计2027年发射两颗原型卫星。此系统利用太阳能驱动AI,由卫星星座构成,但面临打造星间链路、控制卫星编队等挑战。
多模态大模型理解物理工具吗?PhysToolBench提出了衡量多模态大模型对物理工具理解的基准
香港科技大学等团队提出 PhysToolBench,用于衡量多模态大模型对物理工具的理解。它将理解分为三个等级,测试 32 个模型,揭示了大模型在工具理解上的不足,也为未来发展指明方向。
ACM MM 2025 Oral | 新加坡国立大学提出FractalForensics,基于分形水印的主动深度伪造检测与定位
近些年来,深度伪造主动防御受关注,但现有方法有鲁棒性不稳定等问题。新加坡国立大学等团队提出 FractalForensics 方法,基于分形水印实现主动深度伪造检测与定位,实验效果良好。
月薪 3500 的 “机器人保姆” 来了!OpenAI 投资的家用人形机器人开售,AI 是核心驱动力
10月28日,OpenAI投资的1X Technologies推出的家用人形机器人NEO开售,早鸟价20000美元/台,也可月租。它硬件出色、AI驱动,能对话、处理家务并持续学习,核心是升级的硬件平台。
如何让Agent更符合预期?基于上下文工程和多智能体构建云小二Aivis的十大实战经验
文章围绕云小二Aivis项目,分析Agent不按预期输出的原因,从预期和技术层面展开。还总结十大优化经验,如清晰预期、精准投喂上下文等,为构建和调优Agent提供参考。