「多步聚合训练」共找到 5695 篇相关文章
京东深夜开源,首个完整通用Agent产品,直指行业SOTA!
京东深夜开源业界首个“开箱即用”完整多智能体产品`JoyAgent-JDGenie`。与大多为SDK或框架的开源项目不同,它是端到端完整产品。在GAIA榜单表现佳,架构清晰且有技术创新,使用和二次开发简单。
OpenAI董事长Bret Taylor:2010 年的 SaaS 应用,就是 2030 年的智能体公司
OpenAI董事长Bret Taylor在对话中称,当下处于“加10倍速的互联网泡沫”时代,AI为初创公司带来挑战巨头的机会。他直言多数B2B公司“以客户为中心”是胡扯,还为AI创业者划红线,如应用公司预训练模型是烧钱。
万亿市值一夜蒸发!Claude Cowork血洗全球软件业,老黄急了
Anthropic为Claude Cowork植入「插件」功能,引发全球软件股恐慌。短短一夜,硅谷软件巨头蒸发3000亿美金,过去一周全球近万亿美金市值没了。Claude插件覆盖多领域,取代传统软件,让SaaS商业模式面临崩塌。
此芯科技亮相世界人工智能大会,以 AI 之力勾勒美好未来
2025年7月26日,世界人工智能大会在上海启幕,此芯科技携多款搭载此芯P1的展品亮相,展示端侧AI前沿成果。此芯P1芯片性能强劲,已产品化。展会展示三大应用场景,呈现其多场景应用能力。
从AI Agent到Agentic AI:开源如何助力开发者解决行业痛点?
2025年全球开源软件项目数量增长,中国企业贡献显著。字节跳动在火山引擎原动力大会开源开发者日上,多位负责人分享开源经验,探讨其为AI Agent带来的技术改变,展示解决行业痛点的理念与实战经验。
ECCV 2026 | 一段视频,重建一个可仿真的动态世界
机器人走出实验室后,训练数据需覆盖真实世界情况。OVOW由多团队完成,被ECCV 2026接收。它从单目视频出发,输出可编辑、可碰撞的实例级Mesh,串联视觉基础模型完成流水线工作,能用于物理仿真。
CVPR 2026 | 从视觉Token内在变化量出发,实现VLM无损加速1.87倍
随着高分辨率图像与长视频处理需求增长,大型视觉语言模型推理效率成瓶颈。V²Drop从视觉Token内在变化量出发,采用多阶段渐进式剪枝策略,实现无损加速,在图像和视频理解场景表现卓越。
Qwen-Image-2.0: 字字清晰,张张细腻
阿里云推出Qwen-Image-2.0图像生成基础模型,具专业文字渲染、细腻真实质感等特色。在AI Arena盲测中表现优越,能精准生成复杂内容,文字渲染有准、多、美、真、齐特点,图像编辑能力也得到增强。
免费开源、可本地部署的AI私人助理Clawdbot,保姆级搭建教程来了
本文提供免费开源、可本地部署的AI私人助理Clawdbot的搭建教程。它能在多平台运行、连接工具和技能。教程涵盖创建虚拟机、安装Node.js和Clawdbot、设置连接等步骤,还介绍技能扩展和VPS运行方案。
获NVIDIA致谢:悟空Agent的实践、复盘与迭代
本文以悟空Agent获NVIDIA致谢为切入点,介绍多智能体架构闭环及实战挑战,如上下文断流、调度失衡。还阐述架构设计、迭代优化、数据飞轮体系,指出AI infra存在安全隐患,强调安全融入业务的重要性。