「推理可解释性」共找到 5628 篇相关文章
阿里智能体多轮推理超越GPT-4o,开源模型也能做Deep Research
通义实验室推出自主信息检索智能体WebDancer,其通过系统化训练范式为构建智能体提供路径,也为在开源模型上复现Deep Research系统提供指导。它在多数据集测试中表现出色,团队还对其未来应用做了展望。
Qwen3技术报告首次全公开!“混合推理模型”是这样炼成的
本文首次公开Qwen3技术报告,介绍其模型架构、预训练及后训练过程、性能表现等技术细节。Qwen3整合两种模式,引入思考预算机制,降低轻量级模型计算资源,在多基准测试领先,多语言支持扩展至119种,所有模型开源。
RL训练总崩溃?R1-Reward稳定解锁奖励模型Long-Cot推理能力
多模态奖励模型对提升多模态大语言模型表现至关重要,但强化学习在奖励建模应用有挑战。快手等团队提出R1 - Reward,解决训练不稳定等问题,在基准上超SOTA模型,还在快手业务场景成功应用。
这个开源项目 OpenStory,把 AI 短剧制作变成了一条可复制的工业流水线!
现在制作完整AI短剧流程繁琐,很多团队是小作坊式生产,效率低且难规模化。OpenStory开源项目站在成熟AI服务肩上,将AI短剧制作工业化,能把剧本变成风格统一的视频作品,解决诸多痛点。
别只用AI写脚本了,现在AI打广告可真是城会玩了!
如今广告玩法新颖,AI能识别短剧画面插入广告,还能生成贴合IP的番外短片。巨量引擎升级的品星云AI营销,打通“洞察 - 创作 - 投放 - 复盘”全流程,重构AI营销玩法,让决策回归简单。
卡帕西都整破防了:AI Coding没门槛,可部署环节真嗯啊的难
AI Coding界明星卡帕西公开吐槽,代码不再是AI编程瓶颈,部署才是。他以自己开发「菜单图片生成器」的经历为例,指出部署环节问题频发。他认为应让AI调用和配置,还推荐了Stripe Projects等优化产品。
具身导航:感知推理是上帝,还是执行控制是命门?| GAIR Live 023期预告
具身导航正从‘几何避障’向‘空间智能’跨越,当前领域经历范式变革。GAIR Live 023期线上圆桌将聚焦其前沿进展与落地问题,邀请两位专家拆解底层逻辑,还给出了核心议题、讨论精华预览及参与方式。
深度体验TRAE SOLO 正式版,总结一点技巧(附完整可重现提示词和源码)
TRAE SOLO正式版面向国际版所有用户全量上线,模型能力提升且限免。它是响应式编码特工,适合复杂任务。有打通‘行动➔验证’闭环、SubAgent管理上下文等亮点,正式版还有多处升级,作者分享实战技巧。
破解空间智能数据稀缺难题,影石开源DiT架构全景生成模型,在线可玩
影石研究院团队推出基于DiT架构的全景图像生成模型DiT360,设计分层混合训练框架,结合透视与全景图像数据,提升真实感和几何一致性。它支持多任务,优于现有方法,为三维场景生成提供新思路。
AICon 2025 深圳回顾:AI Agent 爆火全场,管理与推理优化成新焦点
2025年8月22 - 23日,AICon全球人工智能开发与应用大会在深圳落幕。70 + 嘉宾、800 + 开发者与企业代表参会。AI Agent成全场焦点,企业管理议题意外走红,展示了AI深入企业核心与管理的行业图景。