文本到 3D 生成」共找到 4249 篇相关文章

算法论文8

打破视频推理「先看后想」惯性,实现真正的「边看边想」丨CVPR'26

现有大型视觉语言模型(VLM)在实时场景表现不佳,宁波东方理工大学沈晓宇团队提出TaYS,让VLM从“帧文交错”切换“并行”,实现“边看边想”,在准确性和延迟上表现出色,推动VLM走向更真实应用。

量子位
新闻资讯8

Gemini证明数学新定理!全程没联网

Gemini内部数学版学霸模型FullProof全程不联网,帮数学家证明代数几何领域新定理,即0亏格映射旗簇空间的motivic类等价结论。它埋下关键思路伏笔、独立给出反例,比Macaulay2更优。

量子位
新闻资讯7

Poe:DeepSeek使用率下降50%,快手崛起、OpenAI暴涨

2025年春季,Poe发布AI模型使用趋势报告。DeepSeek使用率降超50%,OpenAI因文生图功能暴涨。文本、视频、推理、图像和音频5大领域中,各模型表现不一,如快手Kling家族、谷歌Imagen 3家族等有亮眼表现。

AIGC开放社区
算法论文8

ICML 2026|表格异常检测能否告别「one-for-one」?OFA-TAD迈向one-for-all通用异常检测新范式

表格异常检测在多领域作用关键,但当前 one-for-one 范式成本高、泛化弱。Griffith 和同济团队提出 OFA-TAD,推进 one-for-all 范式,在多源数据集训练一次即可迁移,实验表现优异。

机器之心
开源动态7

Correlations:氛围测试你的向量模型

Jina AI分享内部调试可视化向量小工具Correlations,它能生成交互式热图展示内容间余弦相似度,提供多种交互方式。工具已在GitHub开源,适用于内容去重、验证引文等场景。

Jina AI
开源动态8

太强了!这个 NotebookLM Skill,真的把 NotebookLM 搬进了命令行!

Google的NotebookLM凭借强大模型能力成AI圈“现象级”产品,如今开发者将其搬命令行,开源神器notebooklm - py诞生,具备AI Agent工具、研究自动化等功能,有多种使用方式。

开源星探
算法论文7

The Batch: 881 | 一千万 token 的输入上下文

Google的Ali Behrouz等人设计“记忆模块”集成类transformer架构ATLAS,能处理一千万token输入。它替代注意力层,训练后在长上下文任务中表现佳,但小模型,大规模表现未知。

DeeplearningAI
新闻资讯8

谷歌打响教育第一枪!发布50+项免费AI教育功能,彻底改变课堂!

Google for Education官宣更新,将以Gemini为首的AI工具免费提供给全球教育工作者,集成Google Classroom和ChromeOS。有Gemini in Classroom等功能,还通过教师主导解决安全担忧,上线数据分析工具。

探索AGI
开源动态7

Lovart的开源平替产品,完全本地免费的AI设计Agent。

Lovart是热门AI设计Agent但使用成本高,现找开源平替项目Jaaz。它接OpenAI绘图API,支持Comfyui等本地工具,能免费本地使用,功能丰富,还将推视频生成功能。

开源AI项目落地
开源动态8

开源RAG又添新军!港大开源多模态RAG神器,多文档格式统一解析、知识图谱索引与混合检索!

在AI信息检索领域,传统RAG系统难处理复杂文档。港大数据智能实验室开源RAG - Anything,可提供端端解决方案,能多格式解析、构建知识图谱和混合检索,优势显著。

开源星探