「模型结构创新」共找到 8562 篇相关文章
三金,又是中国队!全球机器人视触融合挑战赛揭榜
ManiSkill - ViTac 2025视触觉融合挑战赛揭榜,全球42支团队参赛,中国两家具身初创公司包揽三金。该赛事聚焦视触觉融合技术,为机器人行业搭建从实验室到现实应用的桥梁,推动相关算法和硬件进步。
21
本文聚焦vllm v1中管控模型分布式推理的核心Executor部分,介绍其4种类型及适用场景,以mp类型为例阐述Executor - Workers架构,还说明了大小数据在两者间的传输机制及原理。
突破瓶颈,嵌入式AI神经持续学习引擎—Replay4NCL
阿联酋、纽约、巴基斯坦大学研究人员推出Replay4NCL,解决嵌入式AI持续学习难题。它优化记忆重放,有创新架构和训练策略。实验显示其精度高、延迟低、省内存、能耗少,成果将在2025年DAC大会展示。
吴恩达新作:87%推理token用不着,丢掉反而快3倍
吴恩达新作Prefix Sliding指出,模型推理时丢弃中间已贬值token,只保留前缀+滑动窗口,无需训练可提速3倍,配合RL训练能将推理轨迹扩展到10万token以上。该方法为Agent场景提供新思路。
让 AI Scientist 真正“做出材料”, 鼎犀智创完成数亿元 Pre-A 轮融资
AI新材料研发公司鼎犀智创完成数亿元Pre - A轮融资,资金用于模型及技术研发等。该公司技术路线独特,案例显示能大幅缩短研发周期,还将中试放大纳入体系,推动材料研发走向平台化。
李飞飞押注的空间智能:生成的世界,如何「经得起折腾」?
李飞飞押注的空间智能是世界模型主流路线之一,旨在让AI生成可操作三维世界。但当前AI生成世界存在“中看不中用”问题,构建“站得住”的世界面临速度与状态瓶颈,生境科技等实践提供了解决思路。
刚刚,DeepSeek Harness震撼开源:一切皆插件
今天凌晨,DeepSeek Harness(开发者预览版)开源。它是构建智能体的SDK与框架,设计理念为“一切皆插件”,代码量大且模块化,通过配置文件组装不同智能体,还具备多方面创新设计和安全策略。
1w颗星!本地化视频翻译配音工具!
KrillinAI是多功能音视频本地化与增强方案,面向人类用户和AI Agent。它功能全,覆盖视频处理完整链路;特点多,支持CLI调用等;还兼容多种语音识别、大语言模型和TTS服务,可Docker部署。
13.3K Star!终于有人把文档转 Markdown 这件事做好了!
AI 应用普及,企业常将不同格式文档喂给大模型,但转换工具存在诸多问题。Firecrawl 团队的开源项目 anydoc 支持 14 种格式统一转 Markdown,速度快、输出一致,还有浏览器版本保障隐私,提供多种编程接口。
视觉AI从「会生成」走向「能创作」,RabbitVis探索AI应用新范式
随着AI生图能力提升,如何让AI进入创作流程成新问题。兔展智能基于UniWorld - Design视觉AI大模型推出RabbitVis,推动视觉AI从图片生成走向可编辑、可交付的创作流程,解决创作流程断点问题。