全模态推理」共找到 3724 篇相关文章

开源动态8

开源合一智能体沙箱

AIO Sandbox是开源合一智能体沙箱,将浏览器、Shell等整合到同一容器,提供统一安开发执行环境。解决传统沙箱问题如文件共享难,有统一文件系统等优势,文中介绍其安装、用法、特性等。

GitHubStore
算法论文8

RL在Agentic Reasoning中的作用:拨开迷雾,看清本质

近年大语言模型在推理任务能力惊人,但使用外部工具存挑战。传统SFT无法让模型自主调用工具,强化学习虽被引入,但在智能体推理中面临训练效率、稳定性和泛化能力难题。论文从多维度解构智能体强化学习,提出有效方法。

深度学习自然语言处理
算法论文8

Test Time Scaling Law远未达到上限! o4-mini仅15.8%通过率,华为诺亚提出代码HLCE终极基准

华为诺亚研究员推出新编程基准HLCE,含235道竞赛难题。实验显示,顶级LLM在该基准表现不佳,推理模型优势大,IOI交互式题难攻克。研究还发现模型自我认知与推理能力发展不同步,Test Time Scaling Law远未达上限。

机器之心
开源动态8

百度开源视觉理解模型Qianfan-VL!尺寸领域增强+自研芯片计算

今天百度智能云千帆推出新视觉理解模型Qianfan - VL并面开源,含3B、8B和70B三个版本,基于自研昆仑芯P800计算。它特点多、性能优,应用场景广,未来还将推新产业级模型。

量子位
推荐文章7

别再四处找教程了,OpenClaw 网最接入方式替你整理好了

OpenClaw爆火,但安装劝退很多人。作者梳理其接入方式,有手动、AI一键安装等,还介绍替代品及大厂云端部署方案。另外提到代装服务,强调先用上探索其边界很重要。

特工宇宙
算法论文8

图与切片并非等价?LLaVA-UHD-v3揭示差异推出高效图建模方案

随着多模态大模型发展,处理高分辨率图像成关键。主流视觉编码范式难兼顾性能与效率,清华和中科院团队发布 LLaVA-UHD v3,提出 PVC 框架,对比 SBE 和 GNE,验证其在提升效率同时保留模型能力。

机器之心
开源动态8

恐怖的 361k+ star!这应该是我见过最给力的宝藏项目,网最

介绍GitHub上的开源项目`free-programming-books`,它汇集海量免费编程学习资源,涵盖编程语言、框架、工具等多方面,有361k+ star。资源广、更新快、结构清、支持多语言,使用简单。

开源先锋
推荐文章8

Anthropic 发布 AI Native 流程实践指南

Anthropic应用AI团队发布实践指南,阐述如何将AI融入软件开发生命周期各环节。指出代码不再是瓶颈,构建快但周边流程慢。指南围绕六阶段展开,给出实施步骤、治理框架和度量指标。

AGI Hunt
推荐文章7

网疯传的《OpenClaw橙皮书》更新了

《OpenClaw橙皮书》爆火,X浏览量超180万,飞书文档2天访问超10万+。v1.1版本新增国产Claw产品选购指南、安事件及OpenClaw新功能。文档用Claude Code创作,有大量人工环节。

花叔
产品应用7

DeepSeek-R1 更新,思考更深,推理更强

DeepSeek R1 模型完成小版本升级至 DeepSeek - R1 - 0528,用户可在官网、APP 等体验,API 同步更新。该版本强化深度思考能力,在多基准测评表现优异,还改善幻觉、提升创意写作等能力。

AI工程化