可审计性」共找到 4360 篇相关文章

算法论文8

ACL 2026 综述:从事后解释到内生解释,大模型内生解释的前沿进展

大语言模型强大但解释成问题,过去多事后解释,现更多研究者转向内生解释。ACL 2026 接收的综述论文梳理相关代表方法,总结为五类核心设计范式,指出该方向面临挑战但趋势清晰。

机器之心
算法论文8

生成式推荐补上关键一环!语义ID首次实现微分联合优化 | SIGIR'26

生成式推荐依赖语义ID,现有语义ID常先学好再冻结,与推荐目标不一致。论文DIGER首次将微分语义索引机制引入生成式推荐框架,让推荐损失参与语义ID学习,还设计策略解决训练问题,实验表现佳。

新智元
算法论文8

攻克AI过度思考难题!美团新研究让通过“验证”过程奖励激活LRM的高效推理

美团等机构研究团队针对LRM“过度思考”问题,提出验证的过程奖励机制(VSRM)。它结合验证奖励与步骤级奖励,为推理步骤分配奖励信号。实验显示其能降低输出长度并保持能。

量子位
8

12月首炸!灵 O1 正式发布,全球首个统一多模态视频大模型,强得怕!

12月快手旗下灵发布全球首个统一多模态视频大模型Kling O1,标志AI视频进入“全流程语义控制时代”。它将多种视频创作能力统一,有全能引擎等五大亮点,能对比优势明显,让AI视频生成更控。

开源星探
算法论文8

告别高昂重制成本!港科大广州、快手灵发布立体视频转换单步推理新方案

随着 3D 设备发展,人们对 3D 立体视频需求增加,但高昂制作成本成阻碍。快手灵与港科大广州团队联合提出 StereoPilot 模型,能快速将 2D 视频转为高质量 3D 视频,还构建了 UniStereo 数据集。

机器之心
开源动态8

有了它,太丝滑啦,5.3k Star ai-memory!!!

Claude Code 与 Codex 切换时需重述项目情况,5.3k Star 的 ai-memory 解决此问题,它将 Agent 生命周期信息整理成 Git 管理的 Markdown Wiki,提供审计的交接班机制。

小华同学ai
新闻资讯7

AI 智能体未来之争:是迷你应用(GPTs)?还是模块化代码(Skills)?开发者,你站哪边?

Anthropic 公布全新 Skills 功能,让开发者通过模块化组件扩展 Claude 能力,功能覆盖网页、代码环境及 API 接口。它与 OpenAI 的 GPTs 等不同,更强调透明审计,受开发者称赞。

InfoQ
产品应用7

6个Agent组团Vibe Gaming:自己生成、试玩、修Bug

过去大模型生成的游戏虽代码能跑,但常陷入“黑洞”。Spellcaster让多个专用Agent协同处理,形成“生成—运行—检查—修复”循环。目前能快速生成多种游戏原型,未来将用世界模型直接生成画面。

量子位
产品应用8

最强AI PPT Skill!小白3分钟做大片感演示稿

本文介绍了鲸格PPT Skills,它是语义驱动的静态演示系统。区别于多数AI PPT工具,它先理解内容语义再呈现,支持多格式输出,有独特架构、动效和审美规则,生成的PPT编辑、交互强。

鲸选AI
算法论文8

GAIR Paper 107|高校联合腾讯发布 GameCraft-Bench:AI已能端到端开发游戏,Claude Opus 四成达到玩水平

香港中文大学(深圳)等高校联合腾讯发布 GameCraft-Bench,旨在构建基于真实游戏引擎、产物完整运行且能验证的 AI 游戏生成评测基准,解决现有基准难衡量端到端的问题,测试显示前沿模型在游戏生成上仍薄弱。

AI科技评论