「数据问题」共找到 5131 篇相关文章
Hugging Face开源nanoVLM,750行代码可训练视觉语言模型,简单到令人发指!
Hugging Face开源全新视觉语言模型框架nanoVLM,仅750行代码就能从零训练高效能VLM模型。它在单张H100 GPU训练6小时后,在MMStar数据集准确率达35.3%,且能在免费Google Colab跑。
The Batch: 964 | Claude 亮相另一款 Opus
Anthropic发布Claude Opus 5,这是款视觉 - 语言模型,运行成本低,多任务表现优于Claude Fable 5。它在多项测试中领先,解决了Fable 5的一些问题,但也有易产生幻觉等不足。
上海AI Lab新研究:SFT能泛化,只要满足这三个条件
上海人工智能实验室等团队研究指出,“SFT泛化能力差”定论有局限。SFT泛化能力受优化过程、数据质量与结构、模型基础能力共同制约,研究还揭示其训练中的现象及副作用。
打破碎片化瓶颈!浙大&哈佛开源UniGeo,高保真相机可控编辑
当前主流相机可控图像编辑基于图像扩散模型,应对连续相机运动易出现问题。近日,浙大联合哈佛发布UniGeo框架,在三核心层面注入统一几何引导,克服结构退化,提升视觉质量与跨视角一致性。
30天狂刷60万亿Token,光“榜一”就烧掉140万美元!Meta员工搞出“AI Token排行榜”,结果小扎连前250都进不了?
Meta员工开发“Claudeonomics”仪表盘统计员工AI Token使用量,引发“Tokenmaxxing”风潮,上线两天因数据“外泄”下线。30天内全公司Token使用超60万亿,“榜一”花超140万美元,扎克伯格未进前250。
成本降70%!清华、阿里通义带来智能体长程任务新解法
AI智能体处理长程任务常遇上下文超载问题。清华与阿里通义研究人员提出MemPO算法,赋予大模型主动管理记忆能力,准确率提升,计算资源消耗降近七成,不过评价机制有局限。
硅谷AI战火烧进医院!终于可以告别「天书」化验单了
OpenAI和Anthropic的战火燃至医疗领域,OpenAI发布ChatGPT健康,Anthropic推出医疗健康版Claude,还打通数据壁垒,提供个性化健康解答。其还在提升模型能力,保障隐私安全,且各有应用场景。
6.6K标星!微软开源Agent自我优化框架,为智能体注入持续学习能力!
开发AI Agent常面临部署后难自动优化的问题。微软开源的Agent Lightning,加几行代码就能让Agent自动学习、持续优化,有事件追踪等核心能力,安装简单,应用场景丰富。
24个月,从写第一行代码到破产:一位架构师在47个“死亡”项目里,看到的共同陷阱
架构顾问审阅47家初创公司代码库,发现它们因产品无法扩展、技术债积累走向停滞。提出花两周做架构可避免问题,还指出AI虽降低开发门槛,却加速技术债积累。
告别「面瘫」配音,InfiniteTalk开启从口型同步到全身表达新范式
传统video dubbing技术有局限,新兴模型也有问题。美团视觉智能部研发的InfiniteTalk引入‘稀疏帧video dubbing’,实现口型、表情、肢体与音频自然对齐,解决长视频生成难题,技术已开源。