「至强6处理器」共找到 1316 篇相关文章
打造全球首个强化学习云平台,九章云极是如何做到的?
AI正从语言模型走向智能体,强化学习成关键技术,但训练面临困难。2025年6月九章云极发布全球首个工业级强化学习云平台AgentiCTRL,实现系统级重构,其智能基础设施战略布局领先,具产业赋能优势。
伯克利最强代码Agent屠榜SWE-Bench!用Scaling RL打造,配方全公开
开源软件工程模型DeepSWE横空出世,基于Qwen3 - 32B,仅用强化学习训练,以59%准确率刷新SOTA。它采用rLLM框架、R2E - Gym环境,用改良GRPO++算法,还介绍了评估策略及训练挑战的解决办法。
00后投身具身智能创业,剑指机器人界「Model 3」!已推出21个自由度灵巧手
具身智能创业公司灵初智能推出自研灵巧手,每只手21个自由度,操作能力强。其目标是将机器人整机价格打到17000美元,走‘Model 3式的产业破局之路’,还提出分层端到端算法解决训练难题。
英伟达笑到最后!训练2000步,1.5B逆袭7B巨兽,Scaling真来了
英伟达团队提出ProRL训练法,将强化学习扩展到超2000步。用此方法训练的15亿参数模型媲美70亿参数的Deepseek - R1 - 7B,在多任务中表现出色,解决了熵崩溃和训练不稳定问题。
华为昇腾推理对决:开源vLLM vs 官方MindIE,数据说话「Qwen与DeepSeek推理实测」
文章围绕华为昇腾推理,对比开源vLLM与官方MindIE。借助GPUStack平台测试Qwen与DeepSeek模型,分析不同场景性能。指出vLLM和MindIE各有优势,还强调构建国产AI推理生态需多要素,鼓励开源协作。
DeepSeek研究员1200行代码复刻vLLM,H800硬件实测性能反超原版
DeepSeek研究员俞星凯搞出开源项目Nano - vLLM,仅用不到1200行代码实现最小化且完全可读的vLLM。它有快速离线推理、代码可读性强、含优化套件等特点,在H800硬件实测中性能反超原版vLLM。
AI 渗透金融行业:大模型如何破解风控、服务与决策难题?
在数字化与人工智能驱动下,金融行业变革深刻。InfoQ《极客有约》X AICon 直播栏目邀多位专家探讨大模型赋能金融,涉及风控、服务、决策等难题,分享了大模型应用场景、技术渗透、权衡可解释性与性能等观点。
AI Pin 们折戟后,第二代 AI 硬件闷声发了大财
过去两年,第一代AI硬件喊出‘杀死智能手机’口号,赚足目光。当下,创业者不再将取代手机作为目标。第二批AI硬件‘边界感’强,专注细分场景,同时,科技巨头正布局全新AI层,‘隐形OS’雏形已现。
GPT-5七月上线?内部爆料+奥特曼疯狂暗示,自曝前方时刻「令人恐惧」
近日,多方消息显示OpenAI可能7月发布GPT - 5,奥特曼也确认o3 pro快来了。人们对GPT - 5期待颇高,猜测其能力有提升也有局限。奥特曼访谈透露AI会带来多方面变化,应服务个人意志。
250美元起售,还开源,Hugging Face 发布史上最亲民人形机器人
Hugging Face 开源两款人形机器人 HopeJR 和 Reachy Mini,前者全尺寸有 66 个驱动自由度,售价约 3000 美元;后者成本低至 250 美元,可用于测试 AI 应用。虽被指外观不佳,但推动开源机器人生态发展。