生成式视频」共找到 3008 篇相关文章

推荐文章8

从混沌到可控:企业应用中AI Agent不确定性控制的 10 种策略

大语言模型输出的不确定性限制了AI智能体在企业场景的应用,本文总结控制生成AI Agent不确定性的常见策略,涉及技术、应用设计、管理与治理层面,还推荐了相关作品。

AI大模型应用实践
算法论文8

苹果传统强项再发力,视觉领域三种模态终于统一

苹果在大模型领域常受挫,但计算机视觉研究是其强项。其研究团队提出 ATOKEN,这是首个能在主要视觉模态统一处理的分词器,兼顾重建质量与语义理解,成果朝通用视觉表征迈进一步。

机器之心
算法论文8

Meta提出StepWiser,让模型学会“反思”自己的推理过程

Meta提出StepWiser解决大语言模型推理逻辑正确性问题。它训练生成评判模型,通过强化学习在线训练,能解释推理步骤好坏。实验显示其远超传统方法,为构建可靠AI系统提供新思路。

深度学习自然语言处理
新闻资讯7

新iPhone的AI怎么样,得看苹果最近的收购了

苹果官宣iPhone 17发布会,同时据爆料正严肃讨论收购法国AI初创公司Mistral和美国AI搜索工具Perplexity。苹果在生成AI领域滞后,收购或能补短板,但目前收购充满悬念。

量子位
算法论文8

KDD 2025 Best Paper Runner-Up | EI-BERT:超紧凑语言模型压缩框架

香港城市大学王茂林等提出 EI - BERT 框架,解决移动设备部署 NLU 模型难题。通过硬令牌剪枝、交叉蒸馏、模块化量化,实现 99.5% 压缩率。在多任务中表现出色,已在支付宝大规模应用。

机器之心
推荐文章8

美国知名风投 BVP 年度 AI 报告:Memory 和 Context 将是新的护城河

美国知名风投 BVP 发布《The State of AI 2025》报告,研究 20 家 AI 创业公司,梳理 2025 年 AI 创业现状,认为记忆和上下文是新护城河,还对未来趋势如浏览器竞争、视频生成等进行了预测。

Founder Park
算法论文8

ICCV2025 | One image is all you need,多模态指令数据合成,你只管给图,剩下的交给Oasis

近年来多模态指令数据合成依赖人工设计提示词,成本高。本文提出 Oasis 方法,仅靠图像生成数据,打破传统输入模,还开源代码库 MM - INF。实验显示其数据多样,能提升 MLLM 性能。

机器之心
新闻资讯8

百度搜索 10 年来最大改版,支持超千字长文本输入和 MCP 调用

7月2日,百度搜索宣布十年来最大改版,搜索框变“智能框”,支持超千字输入,集成AI写作等功能。“百看”功能、AI助手升级,接入视频生成模型MuseSteamer,还接入1.8万+MCP,提升搜索体验。

InfoQ
算法论文8

大模型“拼好题”,45K数据撬动18%提升,数学问题拒绝死记硬背 | MathFusion

上海AI Lab等团队提出MathFusion,通过三种“融合策略”生成新的融合数据集MathFusionQA,仅用45K合成指令,在多基准测试中平均准确率提升18.0个百分点,增强模型解决数学问题的能力。

量子位
算法论文8

ICML 2025 | 如何在合成文本数据时避免模型崩溃?

随着生成AI发展,合成数据成大模型训练重要部分,但可能引发“模型崩溃”。ICML 2025会议上,上交大等团队剖析此问题,提出Token - Level Editing策略,避免模型崩溃,实验验证了其有效性。

机器之心