长时任务」共找到 2883 篇相关文章

算法论文8

推理扰动高熵词,增强LLM性能

香港科技大学(广州)研究团队发现LLM推理,一小部分高熵词显著影响输出正确性。基于此提出MTI方法,含Selective CFG intervention与Lightweight negative - prompt guidance,无需额外训练,能提升模型推理能力。

机器之心
开源动态8

北大开源统一世界模型框架:多类合成推理任务一套搞定

世界模型研究中,不同任务存在接口不统一等问题。北大DCAI课题组联合多方推出OpenWorldLib推理框架,整合多模态能力,构建标准化接口体系,在多任务上评估效果良好,降低研发门槛。

量子位
开源动态8

Soul App 又又又开源了!这次是实交互数字人,支持小视频甚至无限

Soul App 新开源实数字人项目 SoulX-LiveAct,解决 AR 扩散模型流式生成稳定性问题。它实现 20 FPS 实流式推理,延迟 0.94 秒,支持无限,有恒定显存等亮点,可用于多场景。

开源星探
开源动态7

交互式视频生成

文章提出用于实交互式视频生成的帧级自回归框架 LongLive,解决了视频生成在效率和质量方面的挑战,具备视频生成、实推理、高效微调等亮点,还给出安装、推理、训练等步骤。

GitHubStore
开源动态8

边打字边出片,交互式生成视频!英伟达联合MIT开源新SOTA

AI拍视频不再难!英伟达联合MIT推出LongLive,可实交互生成流畅画面,解决传统方法卡顿、不连贯等痛点。它能生成15秒到240秒视频,性能达SOTA,还靠三把“钥匙”解决、顺、快难题。

新智元
算法论文8

突破视频生成瓶颈:南大、TeleAI推出全新AI生成范式MMPL,让创意一镜到底

当前AI视频生成面临质量骤降、细节崩坏、生成低效等问题。南京大学联合TeleAI推出MMPL新范式,首创“宏观规划、微观执行”双层生成架构,实现分钟级高质量视频稳定生成,效率显著提升。

机器之心
算法论文8

ACL 2025杰出论文!用能力显著向量让大模型下游任务性能预测更精准

上海人工智能实验室与复旦大学联合研究成果《Capability Salience Vector》获ACL 2025杰出论文奖。提出能力显著向量(CSV)解决验证损失与下游任务能力脱节问题,实验验证其提升了下游任务表现可预测性。

OpenMMLab
开源动态8

机器人需要一个「思考系统」:τ0-VLA让具身智能迈向任务

2026 WAIC落幕,具身智能成焦点。当前VLA模型在任务中有局限,上海创智学院和智元机器人联合发布τ(0)-VLA,提出分层架构和新推理机制,用大量真机数据训练,在任务表现出色。

机器之心
开源动态7

离谱!我以为 OCR 还在一页页抠字,结果百度 1.2 万 Star Unlimited-OCR 直接把文档一口气读完

百度开源的Unlimited - OCR项目目标是处理图片、文档等资料,将其转化为Markdown等结构化结果。它提供多入口,解决传统OCR处理文档的问题,有多种应用方向,但也有边界。

小华同学ai
新闻资讯7

为什么「高价值任务」成了所有 AI Labs 的T0 级战略?| 拾象 AGI 备忘录

过去一季度模型进步显著,头部 AI labs 战略对齐,将 coding 列为 T0 级战略,争抢高价值任务。文中还探讨了 AI 对企业 SaaS 的冲击、ToC/ToB 二分法的过、硬件挑战及高价值任务的二八结构等问题。

海外独角兽