「推理密集型检索」共找到 2274 篇相关文章
杀疯了!单卡4090跑通全量微调,面壁1B级多模态性能怪兽硬刚大厂
面壁智能推出MiniCPM-V 4.6,参数约1B,性能和推理效率出色。它在多模态任务综合能力、推理速度上领先竞品,靠ViT架构改造和4倍/16倍混合视觉Token压缩实现创新,有工业验证,对开发者和普通用户意义大。
社区供稿丨Jina-VLM:可在笔记本上跑的多语言视觉小模型
Jina AI发布2.4B参数量的视觉语言模型Jina - VLM,在多语言视觉问答任务达SOTA。它引入注意力池化,连接视觉与语言基座,处理问答等任务,对硬件要求低,多项测试表现优,还介绍架构、训练策略和上手方式。
第二代InfLLM开源,同尺寸快三倍!零参数,可训练稀疏注意力
新智元报道,清华、OpenBMB和哈工大提出零额外参数、训练高效的原生稀疏注意力框架InfLLM-V2,仅用5B长文本词元就能完成训练,相比稠密注意力机制有显著加速,性能接近传统稠密模型。
究竟会花落谁家?DeepSeek最新大模型瞄准了下一代国产AI芯片
近期,DeepSeek发布V3.1新模型,采用全新混合推理架构,在多任务表现上有提升。它采用UE8M0 FP8,或为国产推理芯片优化机制。国内多家厂商新一代AI芯片支持FP8,未来国产大模型或针对其专门优化。
开源版AlphaXIV
开源版AlphaXIV可实现与arXiv论文智能对话,打破传统文献阅读壁垒。它利用微软Markitdown转换PDF,用MiniRAG索引内容,借助Google的Gemini API对话,还介绍了功能、问答流程、安装使用等。
PaperDebugger:开源的学术版Cursor
PaperDebugger是AI驱动的学术写作助手,能调试和改进论文,提供智能建议。它用基于MCP的编排引擎,模拟学术流程,有聊天、插入、评论等功能,只读取项目,保障隐私。
Karpathy又封神!掀翻RAG,把你的笔记变成第二大脑
前OpenAI创始成员Andrej Karpathy提出让大模型把笔记「编译」成持续生长的活Wiki,替代RAG。他将笔记当源代码,LLM当编译器,实现知识结构化。此方案降低维护成本,解放人类注意力。
QoderWork Design 上线,设计即代码,不输 Claude Design
阿里 QoderWork 上线设计工作台,定位用自然语言做专业设计。与 Claude Design 接近平手且小有优点,有 140 种风格参考,画笔和 Nudge 工具方便修改,产出可直接用于开发的工程文件。
ICLR 2026 Oral | 告别多步去噪!清华团队推出MVP,实现机器人动作单步极速生成
清华大学智能驾驶课题组 iDLab 与加州大学伯克利分校人工智能研究院 BAIR联合发表研究,提出 MVP 策略。它引入瞬时速度约束解决均值流学习问题,设计复合生成与选择机制,在多任务测试中表现出色。
别错过,Clawdbot(Moltbot、OpenClaw)爆火之后,我找到啦 700+ 的技能包~~~
awesome-openclaw-skills是VoltAgent在GitHub维护的「OpenClaw Skills精选清单」,收录700+社区构建的OpenClaw技能,按场景分类,方便安装使用。还介绍了安装方法和技能分类。