「视频生成业务」共找到 3180 篇相关文章
干掉 90% 的 BI 工程师:自动生成 SQL、洞察、预测,连图表都帮你画好
介绍了基于LLM和RAG的结构化数据问答系统,它能将查询转化为SQL语句执行,生成数据图表及分析。其看板用法新颖,可进一步分析、预测,免去大部分BI工作,对非技术分析人员友好。
西交大 x A*STAR 论文:让 AI 学会「保持一致」,多图生成迎来关键突破丨CVPR 2026
西安交大与新加坡A*STAR团队提出论文《PaCo-RL: Advancing Reinforcement Learning for Consistent Image Generation with Pairwise Reward Modeling 》,将一致性问题转为“跨图比较”学习问题,结合强化学习实现能力闭环,提升多图生成一致性。
AI 一键生成网站之后,最残酷的差距出现了:代码不再值钱,审美决定生死
知名前端开发者 Wes Bos 认为,2026 年将是“设计复兴之年”。当 AI 能让任何人快速生成网站,真正的差异化将来自审美、取舍和打造独特体验的能力。如 Lando Norris 官网,靠精心设计吸引关注。
每帧Sora级震撼!Midjourney首个视频模型登场,超逼真大片首测来袭
Midjourney首个AI视频模型V1上线,每月10美金可体验20秒。其视觉效果惊艳,能媲美Sora等,还能一键让图像动起来。成本低,提供多种模式与设置,有技术愿景,未来将完善模块。
抛弃预定义Tool,首次提出通过动态工具生成的Agentic多模态Reasoning,破31%涨幅
视觉推理任务中,传统多模态大模型依赖预定义工具,灵活性与领域适应性差。PyVision 框架首次让 MLLM 在推理中实时生成、执行并迭代 Python 工具,在多类任务中显著提升性能,实现范式跃迁。
首个英文原生「弱智吧」!逻辑谬误数据集与生成框架来了 | AAAI'26
研究发现大模型判断逻辑谬误易误报正常句子,但分类能力较强。研究人员构建英文逻辑谬误基准SMARTYPAT - BENCH,开发生成框架SMARTYPAT,为大模型逻辑评估提供新思路,可用于多领域。
Zig 创始人直言,Bun 靠 Claude 生成的 Rust 重构版是“没人把关的烂代码”
Bun创建者用Claude智能体11天将Bun从Zig移植到Rust,虽通过测试,但Zig创始人Andrew Kelley批评其编程实践不规范,认为代码是‘没人把关的烂代码’,且AI生成代码缺监督会出问题。
Transformer开始构建三维世界:开源模型几张图片秒级生成可探索3D场景
影溯将最新研究成果做成免费3D捕捉工具Crystal空间相机,背后技术QuerySplat已开源。其模型Topos - Lite改变组织三维空间方式,少量图片就能秒级生成3D场景,还能扩展容量。影溯团队经验丰富,技术应用场景广。
AI视频杀出一匹“快乐黑马”:把Seedance 2.0挤下榜首,幕后团队成谜
4月7日深夜,AI评测平台公告Video Arena新增匿名视频模型HappyHorse - 1.0,48小时后积分登顶,超过Seedance 2.0。网友猜测其出自中国团队,有线索指向Sand.ai等联合团队或阿里淘天集团。实测表现有亮点,Elo评分合理性存疑。
长文本生成迎来新突破:拓元智慧推出 DrDiff ,实现效率与质量双提升
拓元智慧联合多团队开发出 DrDiff 框架,解决长文本生成中效率与质量难兼顾问题。其核心是“动态化”,有分层稀疏注意力、动态专家调度、语义锚点状态三个创新组件,经测试表现良好,未来应用值得期待。