物理场景测试」共找到 3834 篇相关文章

新闻资讯8

北大校友Lilian Weng出镜,爆出120亿估值首个交互模型!

北大校友Lilian Weng出镜介绍Thinking Machines的交互模型,此模型200毫秒神同步,能感知协作。该公司此前获20亿美元种子轮融资,估值达120亿美元。模型打破传统交互局限,或改变人机互动方式。

新智元
算法论文8

DeepSeek刚解决了AI视觉最后一块拼图:极低成本+精准视觉定位,AI接管电脑已无死角

DeepSeek放出新论文《Thinking with Visual Primitives》,解决多模态大模型中长期被忽视的“说不清位置”问题。提出将空间标记作为“最小思维单元”插入推理链条的方案,在多个任务上达前沿水平,但也存在精度、触发机制和泛化能力等局限。

AI寒武纪
推荐文章7

字节、阶跃之后,张心皓押注Human Loop:Agent Loop赢家通吃,创业要走另一条路

张心皓曾在字节跳动工作10年,后创业,现做Jovida,目标是“从愿望到行动零摩擦”。他认为Claude Code定义纯Agent Loop上限,创业应做Agent in Human Loop,还分享了产品理念、架构、商业化等看法。

Founder Park
算法论文8

ACL 2026 | 别轻易给AI发「~」,它可能会删掉你的整个主目录

西安交通大学等校团队揭示大模型表情符号语义混淆安全漏洞,用自动化框架测试主流大模型,平均混淆率38.6%,多数混淆响应会“静默失败”,超半数达高危害级别。

机器之心
新闻资讯7

群核十五年:一家“被AI重新定价”的公司上市了|甲子光年

群核科技15年后在港上市,其以“酷家乐”在家居设计软件领域渗透高。它正从3D工具商迈向空间智能服务商,早期被低估,如今随AI发展,早期投入成为生产力,转型向机器收费。

甲子光年
推荐文章7

第 4 章 Agent 开发实战

本章面向理解大模型、会 Python 但未系统搭建过 Agent 的工程师,采用「概念 → 最小示例 → 可运行项目」结构,介绍 Agent 开发实战,涵盖 LCEL 拼装、工具暴露等内容,还说明了开发环境搭建方法。

CourseAI
算法论文8

让大模型多模态检索全面超越SOTA!ReCALL框架化解生成式与判别式的范式冲突|CVPR'26

紫东太初团队联合新加坡国立大学攻克大模型检索难题,其ReCALL框架以‘诊断 - 生成 - 校准’闭环体系解决范式冲突,让大模型变身高效检索器,成果被CVPR 2026录用,刷新SOTA性能。

量子位
算法论文8

ICLR 2026 | 机器人不够聪明?VLMgineer让大模型自己「发明工具」,从设计到使用全自动

宾夕法尼亚大学研究者提出 VLMgineer,一个全自动工具设计与使用框架,利用视觉语言模型和进化搜索,让机器人自主设计并使用工具。该工作已被 ICLR 2026 接收。实验显示,它在工具设计上优于人类提示和现有 Benchmark 工具。

机器之心
算法论文8

Nature子刊封面:牛津提出首个百万级多模态心脏基础模型CSFM

牛津大学团队推出全球首个心脏传感基础模型CSFM,能统一分析多源数据,精准诊断房颤、预测死亡风险等。它打破设备壁垒,让偏远地区也能享用顶级心脏监护,推动全球医疗平权。

新智元
算法论文8

Agent RL 总是训练崩?UCLA 这篇论文给了救命稻草!

这篇解读UCLA和威斯康星大学麦迪逊分校论文《ARLArena: A Unified Framework for Stable Agentic Reinforcement Learning》的文章指出,Agent RL训练易崩溃,原因在于多轮交互任务带来奖励稀疏等问题。论文建“竞技场”,提出SAMPO算法提升稳定性,还给出从业者建议。

深度学习自然语言处理