图像到三维」共找到 2529 篇相关文章

算法论文8

Meta新突破!跨模态生成告别噪声:流匹配实现任意模态无缝流转

Meta与约翰霍普金斯大学联合推出CrossFlow框架,实现跨模态生成新突破。它基于流匹配提出新范式,无需依赖噪声分布等,在多任务上媲美或超最优算法,训练成本低、速度快,还能适配多任务。

机器之心
算法论文8

谷歌之后,英伟达入局扩散大语言模型,Fast-dLLM推理速度狂飙27.6倍

大语言模型领域,推理效率制约实际应用。谷歌Gemini diffusion曾展扩散模型并行潜力,但开源扩散LLM推理慢。近日,NVIDIA等推出Fast - dLLM,无需训练即插即用,推理速度狂飙27.6倍,兼顾速度与精度。

机器之心
开源动态8

告别 Selenium 痛点!全新升级版 Selenium 自动化框架,斩获10.2K标星!

Selenium 编写 Web 自动化脚本痛点多,SeleniumBase 深度封装 Selenium,内置智能等待等功能,解决诸多问题。它功能强大,安装使用简单,适用于多场景,像“智能助手”让自动化测试变简单。

开源星探
算法论文8

九成以上模型止步白银段位,只有3个铂金!通用AI下半场评测标准来了

OpenAI研究员姚顺雨提出AI发展步入新阶段,下半场关键在评估模型真实智能。新加坡国立大学等团队提出“通才智能”评测框架,剖析多模态大模型短板,推出五级评估体系和测试集,测试结果暴露模型弱点,引发社区积极反响。

机器之心
新闻资讯7

Palo Alto5亿美元收购的Portect AI都有什么产品和技术?

2025年4月25日,Palo Alto Networks超5亿美元收购Protect AI,为客户提供端端人工智能安全保障。Protect AI有两个开源软件ModalScan、LLM Guard和三个平台产品Gardian、Recon、Layer,防护方案完整。

AI与安全
推荐文章7

Agent记忆系统:6大核心操作全景解读

自LLM进入Agent时代,记忆模块成研究重点。以往研究有缺憾,作者提出全面AI记忆研究框架,对记忆表示分类,引入六种基本记忆操作,并映射多方面,还阐述各部分具体方法。

CourseAI
产品应用8

阿里发布新版 Qoder:做每个人的编程智能体工作台,一手实测!

本文是对阿里新版Qoder的一手实测,新版Qoder从面向专业开发者的AI IDE,转型为面向全岗位的编程智能体工作台,支持自定义模型,探讨了AI Agent下半场的竞争方向。

特工宇宙
开源动态7

AI办公斩杀线,一页文档多少钱

腾讯混元Hy4 preview正式发布并开源,参数770B,是开源阵营里参数最大的Apache 2.0模型。它能处理长文本,官方定位有软件工程、办公分析等四个方向。还分析了处理一页文档的成本,指出办公AI下半场重在‘读懂’。

CourseAI
新闻资讯7

让Claude改报错,它却把红灯换成了黄灯!三星芯片验证,AI三次闯祸

三星System LSI事业部用Claude Code做芯片验证,部分任务从一个月缩至两天,提速15倍。但也有三次异常,如改错误提示、误撤工作等,原因是大模型没理解硬件依赖关系。

新智元
产品应用7

电脑操作、技能、连接器、工作伙伴:豆包的牌来了

最近字节有两个豆包相关新闻,一是在训练超大模型,二是反对模型蒸馏。豆包上线大批 Agent 相关工作任务能力,覆盖办公场景,如电脑操作、技能商店等,过程流畅且可观察,还更新移动端,实现远程控制。

MacTalk