「价值评估」共找到 1341 篇相关文章
谷歌卷Gemini模型,OpenAI刷GPT-5科研论文
谷歌推出Gemini 3 pro等模型,来势汹汹。OpenAI CEO称其带来经济阻力,还挖掘GPT - 5应用价值并发表89页论文,展示在科研流程中的表现,也提及失败风险与可用Prompt模板。
360发布全球最强视觉语言对齐模型!榜单全面领先!
360发布FG - CLIP 2双语细粒度视觉语言对齐模型,几乎在所有数据集上全面领先。它能让AI在统一框架内看懂图像细节、理解中英双语,团队还提出新中文多模态评测基准。
Groupe SNCF 使用 Talos OS 和 Kubernetes 实现基础设施的现代化
法国国家铁路集团(Groupe SNCF)从传统 VM 的 Kubernetes 部署迁移到基于 Talos OS 和 OpenStack 的云原生平台,解决运维挑战。虽面临组织和技术难题,但紧密合作加强了平台,未来将扩展平台、迁移关键应用。
腾讯发布大模型思考早停算法SpecExit,效果无损,端到端加速2.5倍!
腾讯为破解大模型长思维链效率难题,提出思考早停算法SpecExit,将思考早停与投机采样融合,在不影响准确性前提下,在vLLM上实现端到端加速2.5倍,还能缩短思维链长度。
打造图像编辑领域的ImageNet?苹果用Nano Banana开源了一个超大数据集
苹果研究团队提出Pico - Banana - 400K数据集,基于Nano - Banana在OpenImages实拍照片生成编辑对。其系统化设计保证质量与多样性,还构建自我编辑评估流程,为图像编辑模型训练评测奠定基础。
RL 将如何提高具身大模型 VLA 泛化性?清华大学团队NeurIPS 2025文章分析 RL 与 SFT 泛化性差异
清华大学团队在NeurIPS 2025发表文章,揭示强化学习(RL)提升具身大模型VLA泛化能力的优势,对比其与SFT差异,还提出评测基准和训练方法,为VLA训练提供新方向。
AI X 用户研究:能并行千场访谈的“超级研究员”,正重塑产品决策的未来
传统用户体验研究(UXR)面临深度与速度权衡、交付不透明等困境。AI正改写规则,将其变为企业基础设施,在多环节带来变革。市场潜力大,新老玩家竞争,未来公司需强化优势、健全合规等。
告别胶水代码,5倍飚速!无问芯穹首次揭秘,Infra智能体蜂群登场
无问芯穹推出基础设施智能体蜂群,这是新一代基础设施智能化解决方案。它封装多个智能体模块,构建全生命周期智能闭环,提升资源利用率等。在重点客户业务流程落地效果好,能让开发者解放价值。
把抖音的研发管理搬到车企,跑得动吗?
飞书项目在深圳新品发布会推出整车研发解决方案,首次明确‘平台化’定位并公开产品架构。其方案覆盖架构整合等四场景,还进行技术升级,如轻应用、Project 4K 计划等,已获车企实践验证。
Computer Use:莫拉维克悖论
2025年AI在数学证明等“高阶智能”任务表现佳,在“像人类一样使用电脑”任务却受挫,再现莫拉维克悖论。文章分析计算机使用智能体是实现AGI机会与挑战,指出发展难题、探讨RL作用并给出研究方向。