「深度思考大模型」共找到 8368 篇相关文章
DeepSeek开招Harness产品经理!「参与Agent桌面端产品全过程」
DeepSeek热招Agent Harness产品经理,旨在将前沿模型能力转化为领先Agent产品。招聘详情明确职责与任职要求,释放模型和产品两手抓信号,且其融资后有商业化承诺,将加速发展。
一百万亿Token里的AI现状:OpenRouter和a16z重磅研究带你透视AI江湖
OpenRouter和a16z发布重磅研究,用100万亿Token绘制AI实景地图。2025年推理模型崛起,开源模型流量份额攀升,编程与角色扮演需求大,还揭示了用户留存的“灰姑娘效应”等,展现多元AI世界。
一夜颠覆Sora神话,H200单卡5秒出片!全华人团队开源AI引爆视频圈
UCSD等机构发布FastWan系模型,用「稀疏蒸馏」训练方案,让视频去噪速度飙升70倍。FastWan在单张H200上5秒生成480p视频,模型权重等全开源,改写AI视频生成格局。
让AI学着“看菜下碟”!港中大等新框架让推理长度减少90%,准确率反增17%
香港中文大学等研究者提出TON选择性推理框架,使视觉语言模型能自主判断是否推理。该框架有两阶段训练机制,实验显示其让推理长度最多减90%,准确率还提升,有益模型部署。
构建能源领域的AI专家:一个多智能体框架的实践与思考
本文介绍阿里团队在能源领域构建多智能体框架的实践。因单智能体处理复杂任务有“注意力发散”问题,团队研发综合能源智能体平台,阐述框架搭建、各组件功能及设计考量,还分享思考与可优化点。
具身智能空间视觉死穴,终于被最新顶会彻底解决!
招商局先进技术研究院下属实验室提出新的移动数据范式,以极低成本破解 VLA 的空间泛化瓶颈。研究团队识别出 VLA 模型三种捷径学习模式,提出层次化数据解耦策略,该方案在主流 VLA 模型上验证有效。
Sam Altman:美国严重低估中国AI实力,OpenAI开源因为DeepSeek
OpenAI联合创始人Sam Altman警告美国可能低估中国AI进展,出口管制难限中国发展。他称中国在多层面有进展,美国政策难跟上技术现实。此外,中国开源模型如DeepSeek促使OpenAI发布开放权重模型。
无需人工标注!AI自生成训练数据,靠「演绎-归纳-溯因」解锁推理能力
新加坡国立大学等机构研究者提出元能力对齐训练框架,模仿人类推理心理学原理,将演绎、归纳与溯因能力融入模型训练。实验显示,该方法提升模型在多任务上的性能,且有跨领域可扩展性。
员工吐槽“给 AI 擦屁股”更辛苦?揭秘企业 AI 提效的“悖论”与真拐点
InfoQ《极客有约》X AICon 直播探讨企业 AI 提效实战。嘉宾指出用工程化手段控制模型‘幻觉’、做好数据治理很关键。还讨论了模型使用、数据处理、提效感受、招聘标准、场景选择等问题。
推荐系统进入「双动力」时代!首篇LLM-RL协同推荐综述深度解析
强化学习是推荐系统主流建模范式,但传统 RL 推荐系统有诸多瓶颈。大语言模型崛起带来新机遇,LLM 与 RL 结合开启新范式。研究团队发布首篇相关综述,提出五大协同范式,总结评估体系,分析挑战与方向。