「生成式视频模型」共找到 9038 篇相关文章

8

软件正在发生根本变化:Andrej Karpathy 旧金山 AI创业学院演讲万字实录

Andrej Karpathy在旧金山Y Combinator AI创业学院演讲,指出软件正进入“软件3.0”时代,大语言模型(LLM)是新型计算机,能用英语编程。他探讨了LLM特性、生态,以及如何利用其构建部分自治产品等。

AI寒武纪
开源动态8

搜索智能体RAG落地不佳?UIUC开源s3,仅需2.4k样本,训练快效果好

当前 Agentic RAG 落地有挑战,UIUC 和 Amazon 提出 s3 训练范式。它仅需 2.4k 样本,训练快且效果好,解决了优化目标偏离、检索与生成耦合等问题,在通用和医学 QA 任务中表现出色。

机器之心
开源动态8

PaddleOCR3.0全面开源!文档解析PP-StructureV3:PDF秒变高质量结构化文件!

在大模型与RAG技术发展下,结构化数据愈发重要。飞桨团队打造PP - StructureV3并随PaddleOCR3.0全面开源,它能将文档精准转为结构化文件,有精度高、能力多等优势,还介绍了使用方式。

开源星探
产品应用8

抢先OpenAI?AIUI全新升级燃爆22亿终端,国内大厂定义智能交互

科大讯飞围绕智能交互场景,对AIUI、机器人超脑等4大平台全面升级。其AIUI以大模型为引擎,有儿童专属交互方案,还推出智能眼镜“三麦阵列”等,各平台在多领域应用成果显著。

新智元
产品应用7

我承认,我还是把AI应用想简单了

过去我们把AI应用想得简单,仅定义为聊天框等。生成式AI可构造全新产品逻辑,催生AI原生应用。‘1000 AIdea应用计划’涌现诸多创意作品,如火星种土豆、星童伙伴等,6月20日上海峰会将展示成果。

InfoQ
新闻资讯8

SIGGRAPH 2025奖项出炉:上科大、厦大入选最佳论文

本周三,全球图形学顶级会议 SIGGRAPH 公开今年论文奖项。该会议影响力高,涵盖动画、生成式人工智能等多领域。今年有上科大、厦大等校论文入选最佳,还有时间检验奖等,涉及动力学框架等研究。

机器之心
算法论文7

一招缓解LLM偏科!调整训练集组成,“秘方”在此 | 上交大&上海AI Lab等

上海交大和上海AI Lab联合团队提出IDEAL方法,可提升LLM综合性能。研究发现SFT阶段数据数量非关键,配比不当会加剧模型“偏科”。以Llama3.1 8B测试,IDEAL能提升代码能力,还指导了超参数选取。

量子位
新闻资讯7

Vector数据库退位,AI记忆Memvid登场!

近期基于视频的AI记忆库Memvid大火,宣称革新AI记忆管理,能将文本片段存于MP4实现快速语义搜索。不过网友分析,它底层用FAISS,读写慢、文件大,仓库issues也显示其性能与声称相反。

PaperAgent
产品应用8

Karpathy教你值回ChatGPT 200刀「票价」,初创工程师揭秘ChatGPT最核心能力

AI大神Andrej Karpathy用一张图教你选ChatGPT模型,给出使用指南,如简单问题用4o,困难问题用o3等。初创工程师Eric Hayes揭秘其背后复杂记忆系统,含保存记忆、聊天历史等,提升了用户体验。

新智元
推荐文章7

超越 GoF:现代 AI 系统实用设计模式

文章指出AI系统需要设计模式,如GoF塑造软件设计,云计算引入新模式,机器学习社区也有相关模式。文中介绍现代AI系统的5类实用设计模式,含提示和上下文、负责任的AI、用户体验、AI - Ops和优化模式等,并举例说明。

InfoQ