「视觉 - 语言数据」共找到 3799 篇相关文章
ICML 2026|表格异常检测能否告别「one-for-one」?OFA-TAD迈向one-for-all通用异常检测新范式
表格异常检测在多领域作用关键,但当前 one-for-one 范式成本高、泛化弱。Griffith 和同济团队提出 OFA-TAD,推进到 one-for-all 范式,在多源数据集训练一次即可迁移,实验表现优异。
去往 Capital One 的俞栋,曾是 Hinton 的「救命恩人」
近日原腾讯AI Lab副主任俞栋加入Capital One。此前他和邓力曾在微软为Geoffrey Hinton雪中送炭,挽救深度学习研究。如今邓力、俞栋等技术大佬纷纷投身金融公司,或是因薪资、挑战和资源等因素。
CNCF 警告:仅靠 Kubernetes 不足以保障 LLM 工作负载的安全性
云原生计算基金会(CNCF)指出,企业在 Kubernetes 上部署大语言模型(LLM)存在安全缺口。Kubernetes 无法理解或控制 AI 系统行为,需增加额外控制层,引入 AI 特定控制。
马斯克暴走官宣:Grok 5就是AGI!五月连轰两代万亿怪兽,OpenAI慌了
马斯克宣称Grok 5就是AGI,5月将连发1T和1.5T两代万亿参数模型。Grok 4.3已上线,4.4、4.5将相继推出,Grok 5正以6万亿参数规模训练。不过,参数能否堆出AGI存争议。
The Batch: 943|液体和气体如何运动
传统数值方法模拟复杂物理系统慢且贵,基于机器学习的模拟通常只适用于特定系统。研究人员构建通用 transformer 模型 Walrus,可模拟流体运动,开源且在多方面表现出色,有望加速多领域模拟工作。
重磅开源!240亿参数力压Nano Banana 2
4月初,京东探索研究院开源JoyAI - Image - Edit图像模型。它是业内首个将「空间智能」写进底层的开源一体化图像模型,能让模型「理解空间,编辑空间」,在电商和具身智能场景极具价值。
前SpaceX引擎元老押注尘封20年的技术,要用太阳能驱动“轨道战斗机”
前SpaceX引擎元老杰夫·索恩伯格创立的Portal Space Systems获5000万美元A轮融资。该公司押注被NASA搁置20多年的太阳能热推进技术,推出‘Supernova’产品,有望解决深空探测瓶颈。
李飞飞World Labs双模齐发,能「造」超复杂大场景,一手实测
李飞飞的 World Labs 推出 Marble 1.1 和 Marble 1.1-Plus 两款模型。Marble 1.1 提升视觉效果,Marble 1.1-Plus 能生成更大更复杂场景。官方建议初用选 Marble 1.1,创建大场景用 1.1-Plus,还给出了实测和网友案例。
一句话生成无限逼真3D场景!匹兹堡大学新作直击VLM空间推理软肋丨CVPR'26
VLM在3D空间推理上表现不佳,且缺乏合适测试基准。匹兹堡大学团队提出InfiniBench框架,用LLM Agent迭代优化和聚类策略,可按需生成3D场景,还能精准定位大模型空间推理缺陷。
Claude年化收入首次反超OpenAI
最新数据显示,Claude背后的Anthropic年化营收突破300亿美元,首超OpenAI。其大部分收入来自API,企业客户增长迅猛。还与谷歌、博通签数GW级TPU算力协议,2027年供货。