「图像质量」共找到 1021 篇相关文章
成本暴降88%!通义实验室、北大发布ZeroSearch,无需搜索即可激活LLM检索能力
信息检索能力对提升大语言模型推理表现至关重要,但现有方法在训练中面临文档质量不可控和搜索 API 成本高昂两大挑战。为此,通义实验室和北大提出 ZeroSearch 框架,无需真实搜索即可激活 LLM 检索能力,显著降低成本。
3.4K星Apple出品FastVLM:视觉TTFT效率提升85倍,凭啥这么牛!
文章指出VLM在实际生产应用中因高分辨率图像存在效率问题,介绍Apple出品的FastVLM解决方案,阐述其架构、训练过程,展示在多个基准测试的性能,凸显在高分辨率输入下提升效率的优势及实际应用价值。
The Batch: 979 | LLM 清理智能体的“垃圾”
研究人员提出选择性管理智能体记忆之法,小红书Xubin Hao等构建Self - GC。它在送上下文给LLM前,让大语言模型决定内容取舍。测试显示其删历史少且保留必要细节能力强,不过未测其输出质量。
GPT-5.6泄露了!
GPT-5.6泄露,150万Token+神级极简UI下月上线。它在前端有质变,能生成高质量UI,上下文窗口达1.5M tokens。OpenAI采取双版本策略,6月还将迎来Anthropic、Google等模型混战,模型迭代周期也在缩短。
最强多模态模型也拿不到30分?DeepImageSearch定义相册搜索新范式,开启个人视觉记忆的深度搜索时代
人大窦志成教授团队联合OPPO研究院提出DeepImageSearch图像检索新范式,将其从“逐张语义匹配”推向“语料库级上下文推理”。团队构建评测基准DISBench,用ImageSeeker框架评测主流模型,结果显示最强模型单次完美解决查询比例不超三成。
全球首个具身智能开放平台来了!让大模型长出“身体”,像人一样自然表达交互
魔珐科技发布全球首个具身智能3D数字人开放平台魔珐星云,能让大模型‘长出身体’,实现自然表达交互。该平台突破了‘高质量、低延迟、高并发/低成本’的不可能三角,还可驱动虚拟和真实具身。
NeurIPS 2025 Spotlight | PhysX-3D:面向真实物理世界的3D资产生成范式
论文由南洋理工大学 - 商汤联合研究中心 S - Lab 及上海人工智能实验室合作完成,提出首个系统性标注的物理基础 3D 数据集 PhysXNet 及扩展版 PhysXNet - XL,还提出 3D 生成框架 PhysXGen,实现从图像到真实 3D 资产的生成。
【哥飞分享】
Reddit新手如何通过一篇帖子狂赚2000+Karma?Reddit的公平性让新手也能获得曝光,选择合适的子社区和构建有趣的文案是关键。Reddit的流量分配机制让内容质量成为获得曝光的核心,而好的文案能规模化内容的曝光量。
9.7K Star 把 AI 编码的 token 消耗砍了 16 倍
当前AI编码工具默认读取整个项目文件,token消耗高。code-review-graph项目用Tree-sitter解析代码库成图,追踪改动“爆炸半径”,平均省8.2倍token,技术轻量,还能做社区检测。它揭示AI编码瓶颈在信息输入质量。
大模型最难的AI Infra,用Vibe Coding搞定
Andrej Karpathy 力荐的 Vibe Coding 在 AI Infra 开发中常「水土不服」,存在上下文丢失、决策偏离、质量不稳定等问题。文章提出文本驱动的 Vibe Coding 方法,并以 Agentic RL 中的资源调度系统为例验证其有效性,还介绍了相关团队和工具。