「下一像素预测」共找到 1286 篇相关文章
斯坦福与Adobe新研究,模仿蒸馏技术轻松让200亿参数图像生成高质量大模型
斯坦福大学和Adobe研究院联手,用pi - Flow技术让200亿参数文本到图像大模型4步内生成高质量、高多样性图片。此前少步生成有质量和多样性问题,他们推出GMFlow和pi - Flow解决难题,LakonLab是其背后工程支撑。
Temperature Scaling可大幅提高Test-Time Scaling瓶颈!
大型语言模型解决复杂推理问题时,测试时扩展(TTS)是提升性能的途径之一。但传统TTS依赖增加样本数量,性能提升有瓶颈。本文提出温度缩放新思路,实验表明其能大幅提升性能,还给出降低成本方法。
一文讲懂Agent及其主流框架:自己想、自己干、自己复盘的才是好Agent!
文章对比Workflow和Agent,指出复杂多变场景下Agent框架更适用。还介绍AutoGPT、LangGraph等5款主流Agent框架,涵盖其特点、应用场景等,最后提及腾讯云TDAI团队探索数据库与AI结合。
集合通信库VCCL释放GPU极致算力,创智、基流、智谱、联通、北航、清华、东南重磅开源
在超大规模智算集群需求下,创智、基流等多方联合开源集合通信库VCCL。它基于NCCL开发,有智能调度、容错、细粒度观测机制,实测能提升算力利用率、降低故障率,还解决了服务器异构等问题。
我做内容的10条私藏方法论,今天都拿出来分享给你们了。
数字生命卡兹克作为AI领域小有名气的创作者,分享10条内容创作方法论。包括心法上强调活人感、真诚和价值观;战略上重视选题、专业性;技法上用故事思维创作;修炼上关注评论区和数据分析。
Q2 GPU市场,英伟达独占94%,AMD被逼上绝路?
权威机构JPR报告显示,2025年Q2全球PC用GPU出货量环比增8.4%,CPU出货量也同步增长。这是关税恐慌引发的‘囤货潮’所致。英伟达在GPU领域优势巨大,AMD在CPU战场表现出色,三家旗舰产品各有特色。
美国知名风投 BVP 年度 AI 报告:Memory 和 Context 将是新的护城河
美国知名风投 BVP 发布《The State of AI 2025》报告,研究 20 家 AI 创业公司,梳理 2025 年 AI 创业现状,认为记忆和上下文是新护城河,还对未来趋势如浏览器竞争、视频生成等进行了预测。
AI图像水印失守!开源工具5分钟内抹除所有水印
一款名为UnMarker的去水印技术,能在5分钟内去除市面上几乎所有AI图像水印,谷歌HiDDeN已被完全破解,SynthID被攻破79%。它保持较高图像质量,已在GitHub开源,凭消费级显卡可本地部署。
Figure人形机器人首秀灵巧手叠衣服!神经网络架构不变,只增加数据集就搞定
Figure人形机器人首秀用灵巧手叠衣服,在未改变神经网络架构、仅增加数据的情况下,让原本用于物流场景的它习得新技能,完成了端到端的操作,还实现自然多模态交互。
阿里、南开大学发布免训练,视频大模型创新压缩方法
视频模型序列化处理影响推理速度与扩展性,传统token压缩方法在视频理解中有问题。阿里通义实验室与南开联合发布LLaVA - Scissor,用SCC方法和两步时空压缩策略,实验显示其性能优于其他方法。