真实应用」共找到 2626 篇相关文章

算法论文8

视频世界模型跑长序列不「崩」了!用光流约束+历史记忆+多步训练,让动态场景稳如磐石

现有视频世界模型在长时间交互中易出现运动不合理与场景崩坏问题,核心原因是误差累积。MagicWorld提出面向长时稳定性的交互式建模框架,通过光流约束、历史缓存检索和多步聚合训练,有效缓解误差累积。

量子位
产品应用8

全球AI双榜第一!力压谷歌Veo与Grok,Vidu Q3「参考生」之王归来

这个月初谷歌免费开放Veo 3.1视频生成能力,让AI视频更普及,但模型距‘能交付’仍有差距。Vidu Q3带着‘全家桶’回归,覆盖多领域,在权威评测榜单成绩优异,视觉、听觉和场景能力升级。

新智元
产品应用8

全球第一,13个SOTA!我们找到了龙虾界掌管GUI的神

明略科技推出自研 GUI-VLA 智能体模型 Mano-P 1.0,不依赖 API 对接与浏览器场景,可操作桌面软件与网页界面。它在 13 个多模态基准榜单达 SOTA,支持本地运行,数据零上云,采用分阶段开源策略。

机器之心
产品应用8

重磅!Anthropic又一个平台级产品炸场:Harness难题一次性解决,把Agent宠物变成牲口

Anthropic推出Claude Managed Agents,一套为云端大规模构建和部署智能体设计的API套件,已在Claude Platform上线公测。它全托管基础设施,专为Claude模型优化,多家企业已在生产环境使用,还同步发布工程博客解释架构设计思路。

AI寒武纪
算法论文8

微软OEL框架:大模型一次部署,终身进化

微软最新论文Online Experiential Learning (OEL)提出让LLM在真实部署后持续自我进化的框架,无需人工标注等。介绍了在线体验学习的必要性、OEL方法论及实验验证,揭示关键洞察与启示。

PaperAgent
算法论文8

首个用户生活「长程模拟器」来了!LifeSim 重新定义大模型个性化评测

现有个性化助手评测基准与真实用户-助手交互脱节,来自复旦大学等的研究人员提出 LifeSim 框架及 LifeSim-Eval 评测方法。实验显示主流 LLM 处理显性需求尚可,隐性意图识别等方面短板明显。

机器之心
推荐文章7

让 Claude 自己循环干到完成——Ralph Loop 原理与实战指南

文章介绍了Ralph Loop技术,它由程序员Geoffrey Huntley发明,核心是让AI持续工作直到外部验证通过。对比了与主流Agent框架的差异,还列举其真实战绩、使用方法及适用场景。

AI Reading Hub
新闻资讯7

极客部落“OPC 创业者招募计划”正式发布,赋能 AI 时代“一人独角兽”

3月20日,极客部落“OPC创业者招募计划”开放日活动举行,聚焦AI时代OPC创业范式。活动揭牌“极客部落·AI应用生态园”,宣讲扶持政策,发布合作基金,探讨OpenClaw对创业生态影响,助力创业者成长。

AI前线
开源动态8

英伟达龙虾模型开源,12B激活登上成功率全球第四

英伟达发布专为龙虾打造的开源模型Nemotron 3 Super,总参数120B,激活参数12B,在龙虾模型基准PinchBench上成功率全球第四。该模型结合Mamba与Transformer架构,引入多项创新技术,还开源了模型权重、数据集等。

AIGC开放社区
新闻资讯8

黄仁勋罕见长文:AI是一个五层蛋糕

黄仁勋认为AI是由能源、芯片、基础设施、模型、应用组成的五层蛋糕,是像电力、互联网一样的基础设施。目前AI建设刚起步,虽已产生经济价值,但大部分基础设施、劳动力、机会待实现。

AI寒武纪