相机重定向」共找到 1033 篇相关文章

新闻资讯7

那位曾高喊「AI能接管一切」的CEO后悔了:宣布启人工招聘!

Klarna CEO曾称AI能取代所有人类工作,公司也实施‘AI优先’战略,用AI客服取代人类、缩减人力。但AI客服实际表现不佳,服务体验差,Klarna决定启人工招聘,打造‘高质量人类支持’。

AI科技大本营
产品应用7

别再无脑开高推理!Opus 5高配会擅自构代码乱加戏

有人用FrontierCode编程基准测试Opus 5推理档位,发现性能顶峰在medium档,高档位推理预算多余,会让模型反复校验、偏离需求,在代码场景还会擅自构代码。Anthropic也建议调低推理档位。

量子位
产品应用8

10亿国民App丝滑升级AI应用!高德携手通义构的底层架构曝光

高德用AI构底层技术栈,建立主 - 从Agent架构,将千问大模型与空间智能结合。新架构分Agent层、模型层和工具层,还依托生态数据和通信协议。这让高德从工具变智能体,为行业转型提供范式。

量子位
算法论文8

千万级标注成本归零!CVPR 2025清华团队成果:相机的“自运动”就是最好的老师

以往空间音频模型受限于采集条件和标注成本,清华和密西根大学团队在CVPR 2025给出新路径,利用相机自运动作监督信号,让模型从互联网视频学三维空间音频感知,成果入选会议Highlight。

量子位
算法论文7

token危机解决?扩散模型数据潜力3倍于自回归,训480次性能仍攀升

新加坡国立大学AI研究者Jinjie Ni团队预训练扩散语言模型(DLMs)与自回归(AR)模型,发现DLMs是超强数据学习者,数据潜力超AR 3倍,训480次性能仍攀升,还剖析同期研究方法论缺陷。

机器之心
新闻资讯7

Runway夺全球第一!1247分碾压谷歌Veo3,没有千亿算力也能干翻科技巨头

Runway Gen - 4.5击败谷歌Veo3,以1247的ELO分数在Artificial Analysis榜单中夺AI视频王座。它在多方面树立新标杆,虽有局限,但创始人认为其是通用模拟引擎,应用场景广泛。

新智元
算法论文8

AAAI 2026|新突破:北大彭宇新团队提出可见光-红外终身行人识别方法CKDA

终身行人识别有要应用价值,但现有方法在学习特定模态新知识时,会阻碍跨模态公共旧知识保留。北大彭宇新团队提出CKDA方法,解耦并净化不同模态信息,实现跨模态知识权衡,在相关基准上取得最优性能。

机器之心
算法论文8

不写Prompt,连按Tab完成构:蚂蚁CodeFuse团队提出无指令代码编辑框架NES

在AI coding工具快速演进的当下,蚂蚁集团CodeFuse算法团队在FSE 2026提出无指令代码编辑框架NES。它从历史编辑轨迹学习开发者意图,有双模型架构,实现分三环节,构交互链路,提升开发者体验。

机器之心
产品应用8

Claude Opus 4.1 上线,SWE-bench 验证率 74.5%,构可靠性与安全性全面升级

Anthropic推出Claude Opus 4.1,是Opus 4要升级版。SWE - bench验证率从72.5%提至74.5%,多文件代码构可靠性及长链交互推理能力增强,无害响应率提升,合作率下降,定价不变。

InfoQ
开源动态8

视频世界模型困在像素网格里:腾讯开源SCoPE,用射线空间写位置关系

香港大学、香港科大与腾讯ARC Lab联合提出SCoPE,让视频模型处理位置关系的基底从张量网格转向射线空间。它将相机射线坐标注入Video DiT,新增参数不到原模型0.1%,多方面表现获改善。

机器之心