「AI视频大模型」共找到 13822 篇相关文章

算法论文8

解决扩散模型过拟合的创新框架T-LoRA

预训练大型文本到图像扩散模型定制化时,样本有限易致过拟合。AIRI和HSE大学团队提出T - LoRA框架,动态调整训练能力、用正交初始化,实验显示其在单图像和多图像任务表现优,用户更偏好其生成图像。

AIGC开放社区
新闻资讯7

对话 PyTorch 掌门人 Matt White:AI 应用应该做到“润物细无声”

近日,PyTorch 基金会执行董事 Matt White 在北京智源大会指出,开源虽形成‘良性循环’,但围绕‘开放’定义权的战争已打响。他还分享了对 PyTorch 发展、AI 应用等多方面的看法。

AI科技大本营
新闻资讯7

马斯克甩出两张王牌,Grok Build杀入AI编程

5月14日,xAI上线Grok Build编程智能体,这是马斯克补齐xAI编程短板的第一步。此外,马斯克亮出下一代基础模型Grok V9,它在参数规模、硬件平台、数据质量三方面做了重建。V9公开版上线后,Grok Build将与Claude Code、Codex正面竞争。

新智元
新闻资讯7

AI眼镜:又怕小米做,又怕小米不做

过去一年AI眼镜产品密集落地,小米和Rokid跻身全球出货量前三。市场处于“又怕小米做,又怕小米不做”的微妙氛围,大厂试水但未全力投入,给中小厂商留下建立技术壁垒的窗口期,显示技术或成首个分水岭。

远川科技评论
开源动态7

Qwen 3 VL 模型已并入 llama.cpp,ollama同步支持

近日,Qwen 3 VL 系列模型合并到 llama.cpp 项目,支持图像输入和多轮对话,解决了架构兼容性问题。功能已入主干分支,运行需足够资源。Ollama 最新版同步支持其本地化。

AI工程化
推荐文章8

2026,机器人与AI智能体正在怎样进入艺术现场?

本文盘点2026年以来全球16组机器人与AI智能体艺术实践,展现机器从创作工具转向可自主感知协作的创作参与者,探讨人机创作的身份边界新变化。

MANA新媒体艺术站
新闻资讯7

姚顺雨提到的「AI下半场」,产品评估仍被误解

OpenAI研究员姚顺雨提出「AI下半场」重点转向定义问题,评估重要性超训练。亚马逊Eugene Yan发文补充,指出产品评估常被误解,应运用科学方法,践行评估驱动开发,自动化工具也需人工监督。

机器之心
开源动态8

这款 Rust 文件搜索项目,让 AI 和 neovim 飞起来!

开发时项目大文件多,找文件成本高。Github上的`fff.nvim`项目专注‘极致速度 + 智能体验’,采用Lua + Rust架构,性能好、排序智能。有多项功能特性,还能与AI助手集成,提升效率。

开源先锋
产品应用8

整整21个月,豆包大模型正式进入2.0时代!

时隔21个月,豆包大模型2.0正式推出。它在多模态理解、企业级Agent、推理和代码能力上有提升,在多个基准测评中达业界最优。实测显示其在编程、数学问题处理上性能出色,性价比也具优势。

量子位
新闻资讯7

Sora 关停背后:为啥它没跑成“视频版 ChatGPT”?

OpenAI Sora 宣布关停,其评论区评价两极分化。它没跑成“视频版 ChatGPT”,问题在于使用频率、成本结构和产品形态。关停或与 OpenAI 筹备 IPO 有关,未来 Sora 团队将推进相关研究。

InfoQ