「稀疏自编码器」共找到 1186 篇相关文章
刚刚,DeepSeek开源OCR 2,首创Qwen编码的「双流架构」
年底 DeepSeek 开源新模型 DeepSeek - OCR 2,首创双流注意力架构,model&paper 一同发布。它重构视觉编码器,采用三阶段训练流程,在 OmniDocBench v1.5 评测及生产环境验证中表现良好。
SGLang-Diffusion: 两个月进展
自2025年11月初发布,SGLang - Diffusion获广泛关注。过去两月持续优化,速度提升1.5倍。介绍新模型支持、LoRA支持等进展,还展示性能测试结果,阐述关键改进及未来规划。
少量视角也能得到完整3D几何,即插即用的语义增强重建插件来了
现有神经隐式路线在样本稀疏时有跨视角对应不稳等问题。上海交通大学等团队提出SERES,将跨视角语义一致性作先验注入模型,以低成本解决歧义问题,在多场景提升重建质量。
个人AI知识库的最优解
作者认为2026年搞个人AI知识库,自己的东西放Obsidian,别人的放NotebookLM。介绍了Obsidian接入AI的两种方法,还称NotebookLM性能强,最后总结这两套方案最适合个人。
Claude Science几周干完两年活,10倍科研提速真来了?
2026年6月30日,Anthropic发布Claude Science,定位面向科学家的AI工作台。它将科研拆成可审计流水线,整合工具链,自带可追溯代码,有协调与审查智能体,首落生命科学领域,与Google、OpenAI玩法不同。
我在微信免费养「龙虾」,玩到上瘾,这组CP太强了
2026 开年「龙虾热」渗透各类任务场景,腾讯动作密集。其自研 WorkBuddy 优势明显,与微信 ClawBot 联动成「官配」。经测试,它能高效处理多类任务,还为用户提供权益,腾讯龙虾矩阵加速成形。
清华&Qwen最新论文实证: VLM 智商与机器人操控能力“零相关”
清华和 Qwen 最新论文《VLM4VLA: Revisiting Vision - Language Models in Vision - Language - Action Models》测试 24 个 VLM 模型,构建极简 VLM4VLA 测试,发现 VLM 通用能力与机器人操控能力‘零相关’,还揭示视觉编码器短板。
Agentic Deep Research新范式,推理能力再突破,可信度增加,蚂蚁安全团队出品
尽管LLM能力提升,但在复杂任务上受静态内部知识限制。业界提出Agentic Deep Research系统,不过现存系统有梯度冲突和奖励稀疏问题。蚂蚁安全团队提出Atom - Searcher,解决上述问题,实验效果良好。
不到一年ARR破亿元,GEO厂商智推时代获数千万元天使轮融资 | 甲子光年
近日,AI营销科技公司智推时代完成数千万元天使轮融资,将用于技术研发等。其成立一年多 ARR 破亿,服务近 400 家头部客户。自研 GENO 系统,与华东师大共建实验室,还布局全球市场。
编程能力开源SOTA,网络安全提升2倍!智谱发布GLM-5.3
智谱发布GLM-5.3,743B参数模型,编程能力达开源SOTA。网络安全能力涌现,基准得分是GLM-5.2两倍多。全部提升来自后训练缩放,还自研Z.ai Code Bench评估,安全评估加固后权重将开源。