图像和视频换脸」共找到 7588 篇相关文章

新闻资讯8

OpenClaw 创始人万字访谈:一小时原型,18 万 Stars,Mark Sam 抢人

Lex Fridman对话OpenClaw创始人Peter Steinberger,涉及一小时原型诞生、GitHub爆火、改名风波、MetaOpenAI抢人等内容。OpenClaw作为开源AI Agent,能自修改软件,Peter认为80%的App将消亡,AI虽冲击编程但不会完全取代人类。

AGI Hunt
推荐文章8

吴恩达来信:AI工程技能图谱详解——构建部署AI应用

吴恩达在信中详细展开AI工程技能图谱中构建部署AI应用这一项,介绍需了解的技能,如LLM基础、用数据为模型提供依据等,并阐述各技能要点,还提及构建AI系统与传统软件的区别。

DeeplearningAI
推荐文章8

快手聊了之后才知道,传统搜索早变天了

文章从工程师视角剖析现代搜索,指出传统搜索难适应多模态内容世界。快手推出 UniDex UniSearch,前者变革搜索倒排,后者为统一生成式搜索架构,二者成快手新一代工业搜索‘双引擎’,有广阔应用前景。

MacTalk
开源动态8

腾讯混元开源 4 个小尺寸模型,主打 Agent 长文

8月4日腾讯混元开源四款小尺寸模型,参数为0.5B、1.8B、4B、7B,消费级显卡可运行。模型推理快、性价比高,在多领域表现出色,亮点是Agent长文能力,已在腾讯多业务应用。

AI前线
开源动态7

当AI小说遇上短视频:这款神器让你1秒变导演!

作者小G推荐开源项目TaleStreamAI,它能将AI小说片段转为电影感短视频,具有全自动处理等功能,官方提供一键安装包,对创作者、程序员等有不同价值,开发者还在招募人员。

GitHubStore
开源动态8

一句话生图要过时了?开源图像生成Agent进化出「工具编排」

来自多机构的研究团队提出GenEvolve,将开放图像生成建模为「工具编排轨迹」。它配置三类工具,经多轮决策完成生成。通过构建数据集训练,实验显示在多基准上表现出色,已开源模型、代码等。

机器之心
算法论文8

斯坦福、英伟达伯克利提出具身Test-Time Scaling Law

斯坦福、英伟达伯克利团队提出具身Test - Time Scaling Law。研究发现推理时增加计算量可提升VLA模型性能,揭示动作误差与采样数量幂律关系,还探讨关键问题,给出方法,实验证明结合RoboMonkey能显著提升性能。

机器之心
新闻资讯8

Sora 2深夜来袭,OpenAI直接推出App,视频ChatGPT时刻到了

别家节前卷大模型时,OpenAI 悄悄发布 Sora2 并推出 App,还有配套视频推送算法防成瘾。Sora2 在物理准确性等方面优于以往系统,具备同步对话音效能力,Altman 称是 ChatGPT for creativity 时刻。

机器之心
推荐文章8

科研虾LabClaw接管实验室!斯坦福普林斯顿重新定义人机协作边界

斯坦福普林斯顿团队构建完整AI生态,LabClaw有206个科研技能,可部署为实验室代理;LabOS结合计算与实验,能自我进化;MedOS模仿人类认知用于临床。三者协同重新定义人机协作边界。

AIGC开放社区
新闻资讯7

你天天用的ClaudeCodex,Meta内部不让随便用了

今年5月Meta给工程师划红线,限制用Claude CodeCodex,因其太好用。Meta组建团队自研编程助手MetaCode,担心外部模型输出渗进训练数据,出现“蒸馏陷阱”,且能省钱。

新智元