「JSON-RPC 2.0」共找到 2475 篇相关文章
腾讯发布大模型思考早停算法SpecExit,效果无损,端到端加速2.5倍!
腾讯为破解大模型长思维链效率难题,提出思考早停算法SpecExit,将思考早停与投机采样融合,在不影响准确性前提下,在vLLM上实现端到端加速2.5倍,还能缩短思维链长度。
3D VLA新范式!CVPR冠军方案BridgeVLA,真机性能提升32%
中科院自动化所提出BridgeVLA模型,将3D输入投影为2D图像并利用2D热图进行动作预测。它训练分两阶段,在多仿真基准和真机实验表现卓越,仅3条轨迹基础任务成功率达96.8%,真机性能提升32%。
预测误差仅0.26mm,中科院自动化所×灵宝CASBOT团队让机器人提前“知道你要干嘛”
中科院自动化所与灵宝CASBOT提出DTRT方法获ICRA 2025录用。该方法利用Transformer和博弈论,将人类动态纳入长期预测,实验显示其预测精度和协作表现显著优于现有技术,有巨大应用潜力。
刚刚,英伟达新模型上线!4B推理狂飙53倍,全新注意力架构超越Mamba 2
Jet - Nemotron是英伟达推出的小模型系列(2B/4B),由全华人团队打造。其提出PostNAS与JetBlock,实现架构优化。相比Qwen3等模型,它在多维度准确率更高,H100 GPU上推理吞吐量最高提升53倍。
北大联合阶跃星辰提出TensorCast:统一可编程管理大模型张量,推理「首字延迟」最高降低93.2%
随着模型规模增长、新应用兴起,大模型基础设施面临管理「张量状态」挑战。北大、阶跃星辰与北邮联合提出 TensorCast,解耦张量状态,复用管理能力,在多场景测试中表现出色,为大模型基建提供新范式。
IEEE TVCG | 告别写代码!MoGraphGPT:基于模块化大模型与图形控制的2D交互场景创作
香港多所高校研究团队提出 MoGraphGPT 系统,结合上下文感知模块化大模型与图形化控制,能让用户零代码搭建 2D 交互场景。该成果被 IEEE TVCG 录用,还对比实验验证其优势。
刚刚,千问App把谷歌和OpenAI的「付费绝活」塞进了手机,还免费?
千问App迎来史诗级更新,接入阿里两大视觉模型Qwen - Image和Wan 2.5。Qwen - Image在图像编辑上有强大视觉逻辑理解和一致性保持能力;Wan 2.5能实现原生音画同步。千问App还实现一站式工作流。
具身智能还需要一个「五年耐心」
作者与具身智能领域人士交流后认为,具身智能还需「五年耐心」。当下通用机器人进工业产线挑战大,一到两年或迎「GPT - 3.0 时刻」,但到「GPT - 4.0」阶段还需解决数据、硬件等诸多问题。
2.1K Star!这个 Claude Skills 技能库,给 AI 编程助手装上了 66 颗专家大脑!
GitHub上的开源项目claude - skills迅速走红,斩获2.1K Star。它是全能技能注入包,内置66种专业技能,覆盖12个领域,有300多份深度参考文档,具备上下文感知能力,还整合9套工作流,安装方式多样。
Jina Code Embeddings: 为高质量代码搜索而生的0.5B/1.5B向量模型
本文介绍了 Jina AI 开源的代码向量模型 `jina-code-embeddings`,含 0.5B 和 1.5B 规模,有 GGUF 量化版本。它性能顶尖,支持多任务与 15 种语言,还介绍了训练方案、使用方法等。