「视频AI画质增强算法」共找到 10070 篇相关文章
再封神!OpenAI掀翻AI图像生成,极度逼真,立刻商用
网传OpenAI的GPT-image-2正在灰度测试,韩国网友测试后称其生成图像可‘立刻商用’。它深度融合GPT大语言模型,生成照片更逼真,强化了提示遵循和场景理解能力,让AI图像生成进入‘实用时代’。
实测 MiniMax H3:开源“斩杀线”蔓延到视频模型圈
本文实测 MiniMax H3 视频模型,它 8 月 3 日开源,成本低至 0.5 元/秒,在编辑榜成绩佳。它定位全模态生成,能多素材输入。实测效果好,价格约为 Seedance 2.5 的三分之一,还支持原生剪辑,适配多芯片与工具。
我用豆包工作做了个学术视频解读生产线
作者尹John分享实操经验,利用豆包工作的云端Agent能力,搭建了从热门论文自动生成学术解读视频的完整自动化生产线,仅需用户少量手机操作即可产出成品,还实现了每日自动选题的定时任务。
万字解码 Agentic AI 时代的记忆系统演进之路
文章深入探讨 Agentic AI 时代记忆系统,介绍记忆对智能体的重要性、人脑与智能体记忆的定义分类及操作,还分析 Memory Bank、LETTA 等多款产品实现,总结技术演进趋势,最后提及 Tablestore 的优势。
Meta「透视」AI思维链:CRV推理诊断,准确率达 92%!
Meta FAIR团队在论文中提出CRV方法,可实时观察AI思维过程。它通过改造模型大脑结构,让推理可见。在算术推理实验中,检测精度提升到92.47%,还能让模型修正错误。不过该技术落地尚面临诸多挑战。
AI Agent平台Sedai获2000万美元融资,主打云优化
AI Agent平台Sedai获2000万美元B轮融资,由AVP领投。它聚焦云优化,用智能体取代人工运维,节省成本。产品应用广泛,核心能力突出,2024年收入增长7倍,计划扩平台、引新功能、扩市场团队。
VerseCrafter:给视频世界模型装上4D方向盘,精准运镜控物
复旦大学与腾讯等机构提出VerseCrafter,这是通过显式4D几何控制实现的动态逼真视频世界模型,能精准控镜和指挥物体3D运动。它用独特方法构建4D可控世界模型,实验超现有SOTA方法,代码与模型已开源。
Lex Fridman 对谈谷歌 CEO:追上进度后,谷歌接下来打算做什么?
Lex Fridman 采访谷歌 CEO Sundar Pichai,探讨谷歌在 AI 竞赛中的逆袭、搜索和广告的 AI 模式转变、模型发展、AI 编程提效、AR 前景、自动驾驶挑战等,还谈及 AGI 及 AI 对人类的影响。
奥特曼最新深度访谈:AI至今没有iPhone时刻!
OpenAI首席执行官山姆·奥特曼在深度对谈中复盘大模型发展,谈及砍掉Sora和自研浏览器聚焦平台,认为AI缺iPhone时刻,还分享ChatGPT决策过程、创业经历,提出从成功学经验等观点,反驳末日论。
AI领域全新热门职业,岗位需求今年已增长逾800%
在AI技术飞速发展当下,「驻场交付工程师」(FDE)成连接实验室与市场关键角色。他们兼具算法能力与业务洞察,深入客户现场将抽象模型转化为可落地解决方案。国外企业纷纷扩充FDE团队,国内也开始有类似趋势。