相机重定向」共找到 1033 篇相关文章

产品应用7

高考数学全卷赛!一道题难倒所有大模型,新选手Gemini夺冠,豆包DeepSeek并列第二

因网友质疑上次测评不严谨,此次用六款大模型挑战含解答题的全套高考数学题。结果Gemini 2.5 Pro夺冠,Doubao和DeepSeek R1并列第二。解答题是失分灾区,图像题难倒多模态大模型。

机器之心
推荐文章8

1周半写64个PR、完成30%项目构:一家成熟SaaS公司把Agent塞进研发全流程后

Calendly公开Agentic Engineering实践,Agent嵌入研发全流程,如审查需求、写代码、测试等。一周半内,Agent为IAM团队生成64个PR,完成30%项目构。研发瓶颈从写代码转为判断力,强调好需求与护栏要性。

InfoQ
新闻资讯8

7 小时连续构不掉线!一骑绝尘的Claude 终于遇到对手:Greg Brockman亲自解读AI编程大突破

9月16日,OpenAI推出新模型GPT-5-Codex,专为AI辅助编程工具设计。它在代理编码基准测试中表现佳,形成了覆盖各种需求的交互界面,还具有更优的后训练特性,能连续工作7小时完成复杂构。

InfoQ
新闻资讯8

“商业的HTTP”来了:谷歌CEO劈柴官宣 UCP,Agent 直接“剁手”下单,将倒逼淘宝京东“拆家式构”?

近日谷歌CEO官宣Universal Commerce Protocol(UCP),目标让Agent在线购物。它能拆解购物流程,与多协议协同。谷歌补数据底座,UCP集结众多伙伴,Agent加速落地交易场景,或使电商平台构。

AI前线
算法论文8

AST | 西工大崔榕峰、张伟伟等:基于物理约束与双并行注意力UNet++的高保真度三维机翼流场构研究

传统高保真CFD模拟计算资源消耗大,现有深度学习方法处理三维流场建面临挑战。本文提出物理约束双并行注意力UNet++框架,实验表明其在流场构精度上较传统U - Net提升约10%,预测速度提升2 - 3个数量级。

力学与人工智能
算法论文8

AI生成视频总不符合物理规律?匹兹堡大学团队新作PhyT2V:不训练模型也能让物理真实度狂飙2.3倍!

匹兹堡大学团队提出 PhyT2V 框架,论文已被 CVPR 2025 接收。该框架不依赖训练或大量外部数据,通过链式推理与迭代修正机制,增强主流 T2V 模型物理场景泛化与生成能力,应用前景广。

机器之心
产品应用7

我用AI同传干掉了英语发布会,爽。

作者因听不懂英语发布会,借助豆包同传2.0 API自制AI同传工具。虽开发遇诸多难题,但最终用音频定向解决。该工具能实时翻译,还可复刻音色,也肯定专业译员能力。

数字生命卡兹克
开源动态8

打破碎片化瓶颈!浙大&哈佛开源UniGeo,高保真相机可控编辑

当前主流相机可控图像编辑基于图像扩散模型,应对连续相机运动易出现问题。近日,浙大联合哈佛发布UniGeo框架,在三核心层面注入统一几何引导,克服结构退化,提升视觉质量与跨视角一致性。

新智元
算法论文8

LLM-based Reranker效果到底如何?一项关于SoTA模型的全面分析

在信息爆炸时代,排序是信息检索系统核心。论文对22种排序方法实证研究,构建无污染数据集FutureQueryEval。结果显示LLM排序器泛化能力被高估,轻量级模型有优势,为研究和应用提供指南。

深度学习自然语言处理
新闻资讯7

Stripe x Cursor,硅谷两代“金童”对谈: 未来5年IDE里将不再是代码

本文是 Cursor CEO Michael Truell 和 Stripe CEO Patrick Collison 的深度对谈,讨论了 Stripe 的技术实践、编程的未来。如 LLM 会改变 IDE,未来编程更需求描述;还提到 Stripe 的技术选型、API 写计划等。

海外独角兽