「AI视觉编辑」共找到 10279 篇相关文章

开源动态8

YOLO12改进引入DINOv3少样本目标检测精度飙升,分享训练自定义数据集代码

Meta 人工智能研究院的 DINOv3 是基于自监督学习的视觉大模型,解决诸多问题且无需微调,在多任务表现出色。将其引入 YOLO12 后,在不同规模数据集上检测性能显著提升,还分享训练自定义数据集代码。

机器学习AI算法工程
新闻资讯7

焦虑的贝索斯,决定先裁30000人

亚马逊启动史上最大裁员,先裁14000人,明年或再裁。表面因疫情后人员冗余,实则源于AI军备竞赛压力,AWS优势缩小。公司还计划用机器人替代超50万员工,中层和初级岗位受冲击大,H - 1B员工处境艰难。

新智元
算法论文8

边画边想!多模态Reasoning迎来巨大提升!

论文指出文本无法精准表达空间关系,现有视觉语言模型(LVLM)在空间推理上是短板。ViLaSR让模型直接画图推理,经三阶段训练,在五大空间推理测试中表现出色,还开源资源,有望带来机器认知升维。

深度学习自然语言处理
开源动态8

12.1万高难度数学题让模型性能大涨,覆盖FIMO/Putnam等顶级赛事难度,腾讯上海交大出品

腾讯AI Lab与上海交大团队联合推出首个基于自然语言的数学定理证明框架与数据集DeepTheorem。12.1万道高难度数学“特训题”让模型定理证明性能大涨,7B模型性能比肩或超越现有开源和商业模型。

量子位
产品应用7

10w人看过的龙虾量化系统,评论区骂最多的问题,我花2天补上了。

上一篇龙虾量化系统文章获10w+,评论指出数据是短板。作者经研究找到QVeris,它是统一数据接口平台,使用简单。作者以金融领域为例介绍其用法,还测试其在其他领域的能力,认为它是AI时代的数据基础设施。

探索AGI
新闻资讯7

架构彻底重构!DeepSeek新模型代码曝光,要来的V4让国内外都坐不住了?

DeepSeek官方GitHub代码库曝光代号“MODEL1”新模型线索,或为V4内部代号。代码显示其有重大架构变更,能并行处理稀疏与稠密计算,适配英伟达新架构。此前R1发布推动中国AI开源生态发展,新模型备受期待。

InfoQ
新闻资讯7

CS博士求职8个月0 offer,绝望转行!斯坦福入学停滞,全美仅增0.2%

曾经热门的计算机专业渐成「冷门」,全美入学率仅增0.2%,斯坦福等校招生下滑。AI自动化初级编程岗位,致就业前景暗淡,如田纳西大学博士生求职8个月无果。不过也有人认为低迷或为短期,专家建议选培养可迁移技能学科。

新智元
产品应用8

豆包 2.1 Pro:属于普通人的代码能力

作者分享用AI写代码的经历,指出豆包2.1 Pro强化Coding Agent端到端交付能力,成本低。还展示用它做的多个案例,如歇后语扭蛋机、文件整理工具等,认为其能解决日常问题,降低Coding门槛。

刘言飞语
产品应用8

Claude Design杀死Figma,但这与Figma无关

4月17日上线的Claude Design让Figma股价当天跌近7%。前有Anthropic CPO辞掉Figma董事职务,后新产品登场,一气呵成。Claude Design让非设计师出视觉稿,Anthropic意在打造从想法到上线产品的闭环,或让“中介型SaaS”失势。

花叔
产品应用7

马斯克脑机接口团队成员出走,他们想把“清醒梦”变成消费电子产品

Prophetic AI是一家致力于研发非侵入式头带以诱导清醒梦的初创公司。其核心设备The Halo通过经颅超声刺激实现神经调节,还发布了大模型Morpheus - 1诱导并稳定清醒梦,但此方法论引发了诸多争议。

DeepTech深科技