「员工绩效评估」共找到 1078 篇相关文章
准确率腰斩!大模型视觉能力一出日常生活就「失灵」
EgoCross项目团队聚焦跨域第一视角视频问答评测,揭示现有MLLM在多场景泛化瓶颈。团队提出跨域第一视角视频问答基准EgoCross,经测试揭示模型短板,验证改进方法潜力,研究入选AAAI 2026且数据集等已开源。
OPPO AI重磅发布:深度研究智能体,离“真正好用”还有多远?我们给大模型做了一次全身体检
2025年,Deep Research成AI热点,OPPO AI Agent Team对大模型评测。发布论文,开源评测基准FINDER和失败分类体系DEFT,揭示AI“装懂”“缺乏韧性”问题,还分析模型表现并给出发展建议。
61岁贝佐斯创业物理AI!亲任CEO,首轮获投62亿美元融资
纽约时报消息,61岁贝佐斯创立Project Prometheus进军物理AI,亲任联席CEO。公司获62亿美元资金,员工上百人,从顶级AI公司挖人。该领域已有大厂及离职人员入局,竞争激烈。
从华为“弃将”到打造两家上市公司,他如何成为中国“工控之王”?
过去二十多年,朱兴明打破欧美垄断,提升中国工业自动化核心零部件水平。他曾是华为员工,后创立汇川技术,带领其上市,还拆分出联合动力上市。他决策有得有失,如今又瞄准新领域。
360发布全球最强视觉语言对齐模型!榜单全面领先!
360发布FG - CLIP 2双语细粒度视觉语言对齐模型,几乎在所有数据集上全面领先。它能让AI在统一框架内看懂图像细节、理解中英双语,团队还提出新中文多模态评测基准。
Groupe SNCF 使用 Talos OS 和 Kubernetes 实现基础设施的现代化
法国国家铁路集团(Groupe SNCF)从传统 VM 的 Kubernetes 部署迁移到基于 Talos OS 和 OpenStack 的云原生平台,解决运维挑战。虽面临组织和技术难题,但紧密合作加强了平台,未来将扩展平台、迁移关键应用。
打造图像编辑领域的ImageNet?苹果用Nano Banana开源了一个超大数据集
苹果研究团队提出Pico - Banana - 400K数据集,基于Nano - Banana在OpenImages实拍照片生成编辑对。其系统化设计保证质量与多样性,还构建自我编辑评估流程,为图像编辑模型训练评测奠定基础。
田渊栋被Meta卸磨杀驴,但全网疯狂发offer!OpenAI冲来抢人了
Meta裁员风暴扩散,FAIR研究科学家田渊栋等被裁。田渊栋入职十年多,成果亮眼,却在协助处理Llama 4相关事务后被裁。此外,不少刚入职的博士也遭殃。同时,Meta还用AI取代人工审核。
斯坦福:优化器「诸神之战」?AdamW 凭「稳定」胜出
斯坦福大学 Percy Liang 团队研究指出,虽有不少声称能显著加速的优化器替代方案,AdamW 仍为预训练稳健首选,但矩阵型方法在特定数据–模型比例下优势明显。研究还揭示了现有研究的方法论缺陷。
「一只手有几根手指」,你的GPT-5答对了吗?
CMU博士生Tairan He测试发现GPT - 5答错‘一只手有几根手指’问题,指出语言难满足视觉与机器人领域需求,需VLM和VLA模型。编辑部测试发现顶尖大模型面对常识问题也会‘翻车’,还探讨了应对方法。