「观测的暴露度」共找到 10774 篇相关文章
极低成本,复现GPT-4o图像风格化一致性!NUS推出OmniConsistency
NUS ShowLab 推出 OmniConsistency,解决开源扩散模型在图像风格化一致性上与商业 API 的差距。它成本低,能在保持风格化效果时精准保留图像细节等,还解决了风格化与一致性的跷跷板问题,且兼容性强。
30 年 FAANG 大神被 C++ Bug “虐”4年,竟被Claude Opus 4一招解决!
上周 Anthropic 发布 Claude Opus 4,称其为“全球最强编程模型”。本周,有 30 多年 C++ 开发经验的 ShelZuuz 用它解决了困扰 4 年的“白鲸 Bug”,此前用 GPT - 4.1 等模型均无果。不过他认为它像“初级开发者”。
英伟达新“桌面超算”800GB大内存,满血DeepSeek R1能装1个半
英伟达在Computex大会宣布新办公室落户中国台湾省台北市,还推出多款新品。如面向个人的DGX Station有800GB内存,能跑大模型;面向企业的RTX PRO Server可加速多种用例。此外,还发布新平台、宣布合作等。
MinerU又开源了!这次专治OCR跨页失忆症
文档解析领域,MinerU团队开源了专门给OCR结果做“后处理”的4B小模型MinerU - Popo。它能把碎成一页一页的OCR结果重新拼成文档级结构,解决了当前OCR跨页逻辑断裂问题,且效果和成本优势突出。
Agent开始“自我进化”:会出题、会反思,还会自己长出新技能
文章围绕自进化Agent展开,介绍其概念、受重视原因及三大技术路线,涵盖各路线代表工作的特点、评估及对比,指出研究空白如总结者训练等,最后还介绍了基于Agentic AI的全链路数据助手Dola。
Stripe 发布基准测试:AI 智能体可开发集成方案,但校验环节存在短板
Stripe推出基准测试套件,评估AI智能体构建完整Stripe集成方案的能力,测试聚焦金融系统贴近生产环境的集成场景。测试显示,不同任务类型评测结果差异显著,核心瓶颈在于验证环节,当前智能体短板在校验逻辑等方面。
告别多奖励跷跷板:Flow-OPD将多教师OPD带入图像生成
中国科学技术大学等机构团队提出Flow - OPD,这是首个将OPD引入流匹配模型的统一多任务后训练框架。它解决了流匹配模型后训练对齐中多任务的梯度冲突等问题,效果良好,未来有多个拓展方向。
公里级场景也能稳住了,国产团队把长视频3D重建又往前推了一步
浙江大学、地平线机器人和之江实验室的新工作 Scal3R 要解决长视频 3D 重建问题。它借助 test - time training 技术,设计全局上下文模块和同步机制,提升长序列重建稳定性和精度,能处理超万帧几千米的场景。
3.8K Star!港大开源 AI 量化神器:一句话生成量化策略,普通人也能玩懂!
港大开源的Vibe - Trading在投资圈火了,它是AI驱动的多智能体金融工作台,能将自然语言请求转化为交易策略等。有多智能体协作架构,内置64个金融技能、29个智能体团队预设,提供4种安装使用方式。
DeepSeek刚解决了AI视觉最后一块拼图:极低成本+精准视觉定位,AI接管电脑已无死角
DeepSeek放出新论文《Thinking with Visual Primitives》,解决多模态大模型中长期被忽视的“说不清位置”问题。提出将空间标记作为“最小思维单元”插入推理链条的方案,在多个任务上达前沿水平,但也存在精度、触发机制和泛化能力等局限。