时间建模」共找到 607 篇相关文章

算法论文8

全图与切片并非等价?LLaVA-UHD-v3揭示差异推出高效全图建模方案

随着多模态大模型发展,处理高分辨率图像成关键。主流视觉编码范式难兼顾性能与效率,清华和中科院团队发布 LLaVA-UHD v3,提出 PVC 框架,对比 SBE 和 GNE,验证其在提升效率同时保留模型能力。

机器之心
开源动态8

开源TTS语音新标杆!Kyutai TTS:350ms延迟碾压全场,词级时间戳重构!

法国AI实验室Kyutai开源高性能TTS语音模型Kyutai TTS,基于DSM框架,支持流式输入、超低延迟与高保真语音生成,有多项亮点,还给出不同使用方式及应用场景。

开源星探
推荐文章7

从“铁三角”到“六有”组织,北银金科如何打造千人高密度数智化团队?| 极客时间企业版

在2025 DTDS全球数智人才发展大会上,北银金科赵瑞兰介绍数智化转型实践。北银金科构建“ACT”模型,打造“六有”组织文化,开发人力看板等成果,未来愿与伙伴探索AI时代。

InfoQ
推荐文章8

Dario Amodei 万字长文:我们已经没有时间可以浪费了,直面并克服强大AI带来的风险

Dario Amodei万字长文指出,最早2027年或现超诺奖得主AI,人类面临安全威胁。他定义了“强大AI”,分析自主性、滥用、经济颠覆等风险,给出多方面防御措施,强调人类要直面问题。

AI寒武纪
算法论文8

视觉领域的GPT-3时刻!DeepMind首次证明Veo3模型实现对物理世界建模和推理

谷歌DeepMind研究团队论文显示,视频模型Veo 3学会‘无师自通’,能处理多种没学过的视觉任务。研究人员将其能力分四级,还做了定量评估。研究认为机器视觉或正处范式转变边缘。

AIGC开放社区
新闻资讯8

从OpenAI离职创业到估值1700亿美元,Anthropic用4年时间引硅谷巨头疯狂押注

最新消息,Claude背后公司Anthropic即将达成新一轮融资50亿美元,总估值达1700亿,不到半年估值涨近3倍。该公司由前OpenAI员工创立,获亚马逊、谷歌等投资,其模型在代码生成领域优势明显。

量子位
开源动态8

想入局VLA却不知从何下手?NTU&中大开源「终极菜谱」:从基座到频域建模,每一步都有实验支撑

MMLab@NTU联合中山大学的研究推出VLANeXt,从12个关键维度剖析VLA设计空间,每步有实验支撑。它在LIBERO及LIBERO - plus上超越SOTA方法,遇扰动成功率跃升10%,适合不同水平从业者。

量子位
推荐文章7

当我问deepseek有什么延长周末的好方法

作者询问DeepSeek延长周末的方法,其给出工作日压缩、周末扩容、心理延展、进阶管理等策略,还介绍建立“时间折叠”意识,不少豆友分享实践感受。

每日豆瓣
算法论文8

世界模型太慢?西交大提出Fast LeWorldModel:用「动作前缀并行预测」让动态估计加速4倍

视觉规划里世界模型‘想象’过程慢,西安交通大学研究团队提出Fast LeWorldModel,从根本改变预测方式,实验显示其提升了成功率,还大幅缩短规划时间

机器之心
算法论文8

世界模型最新综述!中科院联合MBZ、NTU、Oxford系统梳理前沿进展

中科院联合多机构及顶尖学者合作,系统梳理世界模型建模范式、方法等,归纳为四大分支,还梳理其在多领域应用、基准数据集等,讨论走向通用智能面临的障碍。

机器之心