大模型智能生成大会」共找到 10291 篇相关文章

算法论文8

10秒视频token超5万,O(n²)跑不动?用后训练线性化框架实现1.71倍加速,推理成本大降|CVPR'2026

视频生成进入大规模时代,但计算成本高,自注意力复杂度O(n²)跑不动。研究团队提出LINVIDEO后训练框架,无需数据和重新预训练,实现视频扩散模型线性化替换,保持生成质量,加速推理并降低成本。

量子位
推荐文章8

谁在赚钱,谁爱花钱,谁是草台班子,2025 年度最全面的 AI 报告

Nathan Benaich发布《State of AI Report(2025)》,如AI全景地图,覆盖研究、行业等领域。2025年AI业务赶上炒作,模型竞争激烈,开源、智能体等发展显著,还对未来一年AI发展作出预测。

Founder Park
新闻资讯7

沃顿教授警告:老板用AI正偷偷赚钱,而你还在审它做的17份PPT?

AI跨越关键门槛能完成有经济价值的工作,但也可能产生大量无用内容。OpenAI新测试显示大模型进步快,虽暂难取代人类工作,但智能体工作续航能力大增,人类对其使用方式决定未来。

新智元
推荐文章7

Harness Engineering?不过是把工程常识换个名字

Chayenne Zhao 发文炮轰 harness 概念,认为它只是工程常识换个名字。她以 SGLang 社区构建多智能体系统为例,阐述解决问题的方案和关键决策,还指出真正驱动改进是环境层面,而非模型

AI工程化
算法论文8

ICLR 2026|CMU等团队让AI生成的3D场景真正「站得住」:PAT3D把文生3D从能看推进到能模拟、能交互

现在3D AIGC虽能快速生成场景,但落地有问题,很多场景物理模拟时会暴露物体悬空等问题。CMU等团队提出PAT3D,目标是让生成的3D场景物理上站得住,可用于编辑、交互和仿真,且代码已开源。

机器之心
产品应用7

眼馋苹果刚发布的液态玻璃效果?藏师傅教你提示词一键实现

苹果 WWDC2025 发布的液态玻璃效果引关注,虽卡片中心可读性差,但预计会被广泛使用。藏师傅探索出将其融入网页生成的提示词,介绍了在不同模型上的效果及提示词内容和使用注意事项。

歸藏的AI工具箱
开源动态8

SFT+RL双管齐下:ReasonGen-R1如何破解文生图「指令不遵」难题?

上海科技大学等机构提出 ReasonGen-R1 框架,结合链式推理监督微调与强化学习,提升自回归图像生成模型推理和创作能力,已全面开源。介绍了其训练阶段、实验结果及推理链模式。

机器之心
7

没等VC下场,机器人厂商们先投了一家数据公司

2026年具身智能市场火热,智域基石获灵初智能等四家企业数千万元天使轮融资。其定位第三方数据公司,核心团队背景互补,明确不做本体、模型等四件事,还构建自动化编译管线处理数据。

AI科技评论
新闻资讯7

Cursor 慌了:当 AI 不再需要代码编辑器

Anthropic新模型Opus 4.5编程能力强大,开发者无需逐行审查代码,可直接向智能体下达指令获取成品,这冲击了Cursor代码编辑器业务。虽Cursor收入增长,但面临焦虑,正努力自研模型、拓展企业客户。

宝玉AI
产品应用8

别再手搓测试数据了!AE测试数据智造系统揭秘

本文介绍基于大语言模型的AE测试数据智造Agent,解决AliExpress跨境电商测试数据构造难题。它结合大模型与原子工具库,实现自然语言驱动的全链路测试数据生成,提升测试效率与智能化水平。

阿里云开发者