「参数压缩 - 覆盖假说」共找到 1208 篇相关文章
迎接「万物皆可RAG」时代:最新综述展示50多种多模态组合的巨大待探索空间
大模型常采用RAG技术,多模态崛起使RAG向MM - RAG发展。目前MM - RAG研究初级,华中科技大学等研究者发布综述,覆盖所有模态组合,剖析工作流,提供构建系统的一站式指南。
XcodeBuildMCP:让 AI 像开发网页一样搞定 iOS/macOS 应用
Sentry开源的XcodeBuildMCP项目,打破传统AI辅助开发手动验证循环,通过MCP和CLI让AI代理操作Xcode构建系统,实现自动化开发流程。它配置简单,能覆盖日常开发需求,助力iOS开发迈向‘无人值守’。
用得越多、失业越快?GitHub 大改 Copilot 规则:默认拿个人代码训练 AI,还搬出 Anthropic 挡枪!
当地时间3月26日,GitHub宣布自4月24日起,Copilot Free、Pro和Pro+用户交互数据默认用于训练AI模型,Business和Enterprise用户除外。GitHub称需更多数据覆盖编码场景,但此举遭用户吐槽。
OpenClaw现在可以直接生成视频了,支持12家视频模型提供商
Peter Steinberger宣布OpenClaw新版推视频生成功能,让Agent完成文本到视频流程。它集成12家视频生成提供商,异步生成,使用简单,支持丰富参数配置,官方文档见https://docs.openclaw.ai/tools/video-generation 。
刚开源的口袋级TTS,CPU 即可多语言本地畅用,爽!
传统TTS模型对个人开发者和边缘设备不友好,最近Github上开源的Pocket - TTS仅100M参数,能在普通CPU上超实时语音合成,支持语音克隆,安装简单,适合多种本地语音开发场景。
MiniMax开源技能包:让AI写代码从大学生变资深工程师
MiniMax 官方开源 skills 仓库,能提升 AI 写代码质量,从‘大学生水平’升为‘5年+资深工程师’。其覆盖多种开发场景,支持四种主流 AI 编程工具,配置后重启可用,具体效果因场景而异。
0.9B跑出90%真机成功率!上海交大为VLA补上空间感
上海交大MINT团队提出中间路线Evo - Depth,约0.9B参数,不额外增硬件负担,兼顾仿真与真机性能及部署效率。系统由IDEM、SEM等组成,代码等已开源。
LeCun的世界模型单GPU就能跑了
LeCun世界模型有新进展,开源极简训练方案LeWorldModel,单GPU就能跑,基于JEPA架构,速度快、参数小、控制强且懂物理,完胜此前JEPA方法,训练更简单。
字节硬核开源ComfyUI批量处理插件,ComfyUI调参效率暴增10倍!
在ComfyUI的AI创作中,手动调参效率低。近期字节跳动开源ComfyUI Lumi Batcher插件,支持全参数交叉调试等,可让调参像Excel一样简单,极大提升ComfyUI工作流效率。
今日开展|HICOOL 2026全球创业者峰会
8月26 - 29日,HICOOL 2026全球创业者峰会将在中国国际展览中心(顺义馆)启幕。会期4天,采用“展+会”形式,主论坛覆盖创业全链路,还有五大展区、七大分舞台,亮点多多,值得关注。