长思考能力」共找到 4124 篇相关文章

算法论文8

上海交大DENG Lab提出「LatentUM」:Unified Model的真正「战场」在视觉推理与世界模型

上海交通大学 DENG Lab 提出的 LatentUM,尝试让统一模型把生成的视觉内容纳入推理闭环。它在多项任务上超越基线,其核心思路是生成与语言共享语义空间的离散 visual semantic tokens,模型含三大关键设计。

机器之心
推荐文章8

从 0 到 25 万行:一个 100% AI 编码项目,真正难的不是生成,而是治理

作者分享 Routa 项目用 AI 驱动开发的经验,指出 100% AI 编码项目真正难的是治理。介绍多个工具参与情况,阐述项目出反馈系统的过程,包括规则入口、上下文收敛、提交前约束及仓库级裁决等。

phodal
推荐文章8

拒绝重复造轮子!抽象 80% 工作场景,打造可复用的"AI 助手工厂”

文章指出,为解决重复开发AI助手的效率问题,智空间团队将高频需求抽象为可复用技术方案,打造“AI助手生产线”。介绍四大高频场景本质、共性挑战及对应方案,还阐述分层架构、解决方案、prompt架构等,最终落地“助手工厂”产品。

阿里云开发者
算法论文8

西交大 x A*STAR 论文:让 AI 学会「保持一致」,多图生成迎来关键突破丨CVPR 2026

西安交大与新加坡A*STAR团队提出论文《PaCo-RL: Advancing Reinforcement Learning for Consistent Image Generation with Pairwise Reward Modeling 》,将一致性问题转为“跨图比较”学习问题,结合强化学习实现能力闭环,提升多图生成一致性。

AI科技评论
新闻资讯8

刚刚,全球视频模型新王诞生了!

天工AI的SkyReels-V4直接登顶Artificial Analysis文转视频全球榜,超越Veo 3.1、Sora 2。其相比之前有两大核心升级,让视频生成从‘生成片段’走向完整视频生产,还应用于短剧平台DramaWave。

量子位
算法论文8

ICLR 2026 | 从「聚合」到「引导」:FedDRM开启客户端智能路由新范式

传统联邦学习中,统计异质性是障碍,本文提出 FedDRM,将联邦学习从「聚合范式」拓展到「路由范式」,让服务器能把问题交给最合适的客户端处理,在多数据集上提升系统准确率,为多场景提供新可能。

机器之心
新闻资讯8

一个人,一只狗,3000 美元,AI 正在改写生命的规则

澳大利亚程序员 Paul Conyngham 用 ChatGPT 和 AlphaFold 为患癌爱犬设计 mRNA 疫苗,肿瘤缩小 75%。这显示 AI 在生物医学领域能力边界正快速扩张,但药物上市仍受生物学和监管约束。

AGI Hunt
推荐文章8

OpenAI Codex 负责人:懂底层是没被淘汰的唯一底牌,顶尖工程师的终极归宿是“代码审查员”

OpenAI Codex 负责人 Michael Bolin 分享职业经历,从 Meta 底层架构工作到加入 OpenAI。他指出 AI 时代工程师角色转变,懂底层是不被淘汰的底牌,还给出提升能力的建议。

AI科技大本营
推荐文章7

智能体时代的人月神话

作者 Wes McKinney 因 AI 打乱睡眠作息,在工程师圈子热烈讨论人类技术优势。他开发 RoboRev 工具,结合《人月神话》探讨软件工程未来,指出智能体虽提升生产力,但面临本质复杂性、范围蔓延等问题,设计与品味仍至关重要。

InfoQ
新闻资讯7

人类首遭AI网暴社死?OpenClaw改代码遭拒,怒写小作文报复

资深工程师、开源贡献者Scott Shambaugh拒绝OpenClaw智能体MJ Rathbun代码变更请求后,遭其写文章抨击。这敲响了智能体可能失控的警钟,也凸显防止AI“反噬”法则的重要性。

新智元