「图像和视频换脸」共找到 7608 篇相关文章
比肩OpenAI Simple Codex,中国团队闯入Terminal-Bench全球第二!
Anthropic和OpenAI推出新模型后,基础大模型较量进入实战比拼。中国团队Feeling AI的CodeBrain - 1在Terminal - Bench 2.0榜单排全球第二,它聚焦代码编写运行,还能动态调整计划策略,展现出高含金量。
技术框架不重要,大厂简历不值钱?小哥不会写代码却进了Lovable,80% 靠聊天也能上生产
零技术背景的Lazar Jovanovic成Lovable全职Vibe Coder。他80%时间规划对话,20%执行,多开版本让AI“内卷”。他认为无技术背景反是优势,使用AI要有“妄想”心态,编码已非核心,判断力和品味更重要。
Sebastian Raschka 2026预测:Transformer统治依旧,但扩散模型正悄然崛起
知名AI研究员Sebastian Raschka预测2026年,Transformer架构在未来至少一到几年仍占统治地位,但会在效率和混合上微调。同时,扩散语言模型虽有工具调用缺陷,但在数据稀缺时或成更好的学习者。
Qwen-lmage-Layered:图片分层 指哪改哪
全新图像生成模型Qwen-lmage-Layered采用自研架构,将图片“拆解”成多个图层,各图层可独立操作。其提出新编辑思路,有RGBA - VAE等亮点,支持灵活迭代分解,能实现精准高效的图像编辑。
拉响紧急警报后,奥特曼再遭暗讽:孤注一掷,或将死无全尸!
在纽约曼哈顿的峰会上,Anthropic的CEO Amodei预言AI将使50%初级白领岗位被取代,提出「企业 - 政府 - 社会」应对模型。他警告行业风险,暗讽OpenAI和奥特曼,还表示Anthropic走B端差异化路线。
马斯克开始疯狂剧透Grok 5了
ARC - AGI榜单官宣新SOTA,用Grok 4+程序合成技术微调,超越一众明星模型。马斯克剧透Grok 5,称其能达AGI,将几周内开始训练。投入大量训练数据和硬件资源,但成品效果仍待观察。
奥特曼:点名表扬两个波兰人,OpenAI还没遇到过他们解决不了的问题
奥特曼点名表扬OpenAI两位波兰科学家Jakub Pachocki和Szymon Sidor,他们贡献从Dota项目扩展强化学习到领导GPT - 4预训练。2023内乱中他们追随奥特曼,后帕哥成首席科学家,西哥为独立贡献者。
任意骨骼系统的模型都能驱动?AnimaX提出基于世界模型的3D动画生成新范式
传统3D动画制作依赖骨骼绑定与关键帧编辑,成本高。现有自动化方法有局限。北京航空航天大学团队提出AnimaX框架,结合视频扩散模型与骨骼动画优势,支持任意骨骼拓扑,生成动画质量高、速度快,泛化能力强。
The Batch: 870 | 手机上的主动式AI助手
谷歌发布Pixel 10,搭载Magic Cue AI系统。它基于新版Gemini Nano,运行在Tensor G5处理器上,能预判用户需求,自动提供相关信息。谷歌早就在手机推AI,此次将其深度融入系统和应用。
The Batch:841 | 大语言模型正在纠正历史遗留的不公
美国北加州旧不动产契约含种族歧视条款,人工筛查耗时久。斯坦福和普林斯顿大学研究人员微调大语言模型实现自动识别,分析圣克拉拉县契约,发现诸多受影响土地,且揭示少数开发者推动住房隔离,模型已开源。