「生成式AI应用工程师」共找到 10856 篇相关文章
18岁华人开源成果,火爆具身智能赛道
18岁华人小哥Eddy Xu的初创公司Build AI开源了有史以来最大的人类为中心数据集Egocentric - 10K,含10亿帧画面,规模是同类的100倍,场景扩展至工厂。不过其缺乏多模态信息,且human - centric路线也有局限。
向黄仁勋汇报的英伟达36人
市值第一的英伟达,有36人可直接向CEO黄仁勋汇报,他们分属七个职能板块。硬件是基石,AI等成第二支柱,公关团队配置特殊。介绍了关键将领,还提及管理模式从扁平到可能垂直化的转变及高压文化。
腾讯把WorkBuddy这张王牌,开放给100多家公司|甲子光年
9月2日,腾讯WorkBuddy举办生态发布会,开放平台正式上线,首批引入超百家生态伙伴,开放底层Agent能力。其在AI办公赛道竞争激烈、产品同质化的背景下做出此开放动作,且面临生态繁荣、商业化等问题。
监管叫停外资收购Manus背后,有一个被忽视的关键问题|甲子光年
4月27日,国家发改委叫停外资收购Manus项目。该项目从2025年12月Meta宣布收购起备受关注。此次监管选择外商投资安全审查路径,预示AI时代监管侧重技术控制权,也可能加速VIE架构消亡。
xAI 全员大会实录:递归自我改进、5000 万视频/天、月球上的质量驱动器
本文是 xAI 全员大会实录,覆盖公司核心业务,如重组为四大方向、编程模型递归自我改进、Imagine 视频生成使用量等,还提及 X App 增长、太空愿景等,也指出公司存在高层流失、项目落地不明等问题。
视频模型也能推理,Sora2推理能力超过GPT-5
DeepWisdom团队研究发现视频生成模型能推理,在空间类任务上比图文模型更擅长。团队推出VR - Bench基准测试,构建客观评分体系。实验显示视频模型在空间推理有优势,相关代码和数据集已开源。
开源!强效果,高性能,严隐私?我全都要:OPPO 终端大模型实践
OPPO AI 中心推出开源端侧多模态大模型 AndesVL,含 0.6B - 4B 四档尺寸套件,有通用能力强等优势。它经多阶段训练,OPPO 还构建端侧部署方案,评测显示其在多方面表现优异,未来会继续技术革新。
奥特曼和量子计算奠基人讨论GPT-8
奥特曼在节目中与量子计算奠基人戴维・多伊奇就AI能否发展成有意识的超级智能产生分歧。奥特曼搬出GPT - 8举例试图说服对方,引发网友对AGI定义标准的讨论。
OpenAI谈:大模型为什么会有幻觉?如何避免?
OpenAI论文探讨大模型幻觉问题,指出评测缺陷,像多数AI模型评测非对即错,模型为得分会瞎猜。还从预训练和后训练阶段剖析根源,提议改造评测,引入置信度阈值和错误惩罚机制。
ICCV 2025 | 跨越视觉与语言边界,打开人机交互感知的新篇章:北大团队提出INP-CC模型重塑开放词汇HOI检测
北大团队提出 INP - CC 模型重塑开放词汇 HOI 检测。它提出交互感知提示生成和概念校准两项创新,结合输入图片特性构造提示集合,引入‘困难负样本采样’策略,在两大数据集上表现超 SOTA。