「代码运行部署」共找到 2696 篇相关文章
马斯克20亿送Grok 4上火星!20万GPU造宇宙大脑,一句话生成3D黑洞
发布72小时,Grok 4爆红硅谷,2分钟可部署游戏,一句话直出完整动画。xAI成立两周年,马斯克SpaceX将投20亿,或把模型送上火星。Grok 4算力强,多项基准测试刷新SOTA。
OpenAI 硬件负责人的闭门分享:硬件的「终点」依旧是智能手机
OpenAI 硬件负责人 Richard Ho 认为真正的限制是整个系统,继续依赖 NVIDIA 硬件路径,无法把模型推到下一个量级,因此 OpenAI 要重新拿回 AI 运行的底层控制权。他指出手机不是为 agent 设计的,未来是云边结合,现有手机系统难满足 AI 时代需求。
Harness Engineering 为什么是 Agent 时代的“控制论”?
本文是 George Zhang 对 Harness engineering 的解读。OpenAI 提出新工作方式,让 agent 编码,引发讨论。从瓦特调速器到 Kubernetes 再到如今的 harness engineering,本质都是控制论模式。LLM 或使代码库反馈回路在关键决策层闭合,但校准传感器和执行器是难题。
刚刚,MOSS孙天祥创业,直播AI4AI大规模科研
创业公司Analemma将全球公开直播部署端到端AI研究系统FARS,目标是全自动完成100篇论文,直播预计持续一个月。FARS是无人类干预、纯AI驱动的系统,能完成科研全流程。其创始人是孙天祥,团队年轻且获数千万美元融资。
破解遥感目标的形状与尺度难题,PKINet二代推理提速近4倍!
PKINet - v2是改进的遥感目标检测模型,能处理复杂形状和尺度变化问题。它在PKINet基础上升级,统一条带与方形卷积,部署时折叠为单大核。在多数据集上精度和速度提升,可服务多领域,但对特殊目标仍有检测问题。
告别「想完再做」卡顿!清华StreamingVLA让VLA边想边行动,提速2.4倍
视觉 - 语言 - 动作(VLA)模型“观测 - 生成 - 执行”串行模式致交互卡顿,清华与联想合作提出StreamingVLA框架,引入两项技术实现并行处理,在测试中显著提升效率和流畅度,为VLA模型部署提供新方案。
RLinf上新πRL:在线强化学习微调π0和π0.5
近年来,基于流匹配的VLA模型成机器人领域前沿技术,但训练依赖大量人类演示数据。清华等机构联合推出在线强化学习微调框架πRL,提出两种微调方案,在测试平台验证了有效性,目前代码等已开源。
超越英伟达Describe Anything!中科院 & 字节联合提出「GAR」,为DeepSeek-OCR添砖加瓦
中科院与字节联合提出「GAR」,为构建自然图像的Dense Caption提供新思路。GAR具备精准描述、关系建模和组合推理能力,通过引入新组件,兼顾细粒度与全局上下文,在多测试集表现优异,且代码等已开源。
LLM会梦到AI智能体吗?不,是睡着了也要加班
新智元报道,Bilt部署数百万智能体,让AI在“睡眠”中整理记忆,评估互动,决定信息存储位置。AI记忆与人脑差距大,Bilt和Letta实验展现“主动智能”雏形,提高模型表现。行业也在突围AI记忆缺陷问题。
97年金融男带8只「电商龙虾」全球开店!2个月后同行慌了
阿里版「电商龙虾」Accio Work打通国际站,一个工作台可全包选品、发品等七个岗位的活。它结合多维度数据助力选品,还能进行广告诊断、店铺运营等,在不同商家案例中成效显著。