可验证」共找到 4583 篇相关文章

算法论文8

从单领域到多能力协同:数据混合如何重塑AI的强化学习

上海AI Lab的OpenDataLab团队通过大规模实验剖析可验证强化学习(RLVR)在多领域推理中的机制,发现逻辑与数学数据相互支持、代码推理有跨领域混合效应等,为构建AI推理模型提供关键发现。

深度学习自然语言处理
8

刚刚,李飞飞空间智能新成果震撼问世!3D世界生成进入「无限探索」时代

斯坦福大学教授李飞飞创业公司 World Labs 发布限量开放测试预览版空间智能模型 Marble。输入单张图片或文本提示,它就能生成无限探索的 3D 世界,与谷歌 Genie 有显著区别,还支持导出高斯点云等。

机器之心
产品应用7

Subagents:构建高靠 AI Coding 专家顾问团

文章探讨 Claude Code 的 Subagents 功能在复杂 AI 编程场景的价值与实践。指出复杂 AI Coding 面临上下文膨胀等问题,而 Subagents 创建专属子代理,有 Context 保护等优点,还介绍使用方法、业务实践及相关思考。

阿里云开发者
开源动态8

首发Omni-Flow流式全模态架构,消费级显卡就能跑

面壁智能等联合发布MiniCPM-o 4.5技术报告,公开Omni-Flow流式全模态框架。该模型凭9B参数实现端到端全双工全模态,在消费级显卡运行,还推出在线体验Demo等,性能表现佳,应用潜力大。

CourseAI
新闻资讯8

100个产品原型同时跑、新模型Mythos断层领先,连skills效果都好到让团队意外:Anthropic内部到底在发生什么?

Claude Cowork 工程负责人 Felix Rieseberg 在播客中透露,未发布的新模型 Mythos Preview 带来“断层式跃迁”,在安全漏洞检测等方面表现出色。Anthropic 内部同时跑上百个产品原型,执行成本降低。还介绍了 Cowork 开发、应用及产品打造经验。

InfoQ
推荐文章7

AI 编码 3.0:人机协作,正在走向多 Agent 协作系统化

文章指出AI编码正从2.0走向3.0,2.0解决生成问题,3.0则是执行系统。当Agent进入软件交付流程,协作需从经验驱动转向模型驱动,Kanban和Harness等工具也有了新角色,系统更强调验证和控制。

phodal
新闻资讯7

下周聊:当搜索成为标配,AI 产品都在怎么用搜索?

AI搜索成chatbot标配,产品接入后有新场景也有新问题,用户使用习惯也有变化。创业者需考虑产品初期是否及如何接入搜索。博查为AI供技术服务,下周四邀相关人士线上聊AI产品搜索应用,扫码报名。

Founder Park
产品应用7

14万,家务机器人带回家!斯坦福华人博士具身创业首款产品亮相

斯坦福明星华人博士生创业机器人Memo亮相,售价2万美刀。它颜值高,能做家务,在无剪辑等的demo中有出色表现。其背后是ACT - 1模型,依赖技能捕捉手套数据训练,成本低且用户教它新本领,预计2026年推出。

量子位
算法论文8

斯坦福洗碗机器人新作!灵巧手跟人学采茶做早餐,CoRL 2025提名最佳论文

斯坦福等机构提出DexUMI框架,利用人手将操作技能迁移至灵巧手。该框架通过软硬件创新缩小人手与灵巧手具身差异,在两款灵巧手硬件平台验证,平均任务成功率达86%,数据采集效率提升3.2倍,被CoRL 2025提名最佳论文。

量子位
产品应用7

腾讯「鹅虾」紧急上线!一手实测:养虾门槛归零,QQ飞书钉钉全能接

腾讯昨日上线两个「鹅虾」产品,WorkBuddy是能接入多平台的智能体桌面平台,QClaw预计下周公测,接入微信。作者实测WorkBuddy,考察其生态接入、代码开发等场景表现,还介绍了QClaw特点及腾讯云轻量应用服务器。

量子位