「Bug解决」共找到 2552 篇相关文章
一个模型统一4D世界生成与重建,港科大One4D框架来了
港科大研究团队提出 One4D 框架,可统一 4D 生成与重建,构造同步输出多模态的视频扩散模型,支持多种任务形态。其有 DLC、UMC 等亮点,用合成与真实数据混合策略训练,实验表现佳。
认知重建:Speckit 用了三个月,我放弃了——走出工具很强但用不好的困境
本文作者分享使用 Speckit 三个月的踩坑经历,探讨 AI 编程工具落地难题。介绍复合工程与上下文工程理念,提出 AI 工程化方案,对比传统工具,阐述其设计、落地策略及未来趋势,助力解决企业开发痛点。
让世界模型推理效率提升70倍:上海AI Lab用“恒算力”破解长时记忆与交互瓶颈
上海AI Lab联合多家机构开源Yume1.5,针对视频生成构建可交互“世界模型”的核心难题,提出时空信道联合建模(TSCM),实现近似恒定计算成本的全局记忆访问,展示了世界模型工程化落地的可行路径。
两次拿到陆奇投资,张浩然这次想用 Agencize AI 干掉所有工作流 Agent
Agencize AI 创始人张浩然认为,所有要求用户预先构建工作流的 Agent 都是错的。该产品让用户只需描述意图,就能完成自动化工作,为用户生成个性化软件,连接传统 SaaS 软件。其还谈到未来软件变革及产品壁垒等。
谈一谈TP推理场景下MoE Group GEMM的优化思路
作者在使用H20测试SGLang CUTLASS MoE时,发现其在中小Batch Size场景下性能不佳。为此设计Expert Specialization方案,启动多个不同配置Kernel,依Expert计算特性选合适的。还介绍了该方案在H20和Hx00上的实现细节及性能测试结果。
比传统方法强7倍:Anthropic物理隔离危险知识,重塑大模型安全训练范式
Anthropic团队提出选择性梯度掩码技术(SGTM),在训练阶段将危险知识物理隔离到特定参数并剔除,实现安全性与通用能力更好平衡,抗恢复性是传统方法7倍,还能处理未标记危险数据。
产品研发AI提效实践:PRD智能体在需求领域的提效探索
随着AI发展,企业探索用其优化产品开发流程。文章介绍PRD和系分智能体落地进展,目标提升产研效率、规范文档管理,阐述技术方案、能力展示,也指出RAG链路等方面挑战及后续研究方向。
Jina-VLM:可在笔记本上跑的多语言视觉小模型
Jina AI 发布 2.4B 参数量的视觉语言模型 Jina-VLM,在多语言视觉问答任务达 SOTA。它引入注意力池化,连接视觉与语言基座,支持 29 种语言,能高效处理问答等任务,对硬件需求低。
硬件创业者必看:深谈影石刘靖康
文章是对影石创始人刘靖康的访谈。他谈到上市后团队未松弛,因影像行业苦且目标远大。还阐述做无人机的原因、产品特点,分析不打价格战的理由,指出无人机关键技术和隐形门槛,最后分享对硬件创业等问题的看法。
英伟达巧用8B模型秒掉GPT-5,开源了
英伟达携手港大开源Orchestrator-8B小模型,在HLE测试中分数超GPT - 5,成本低且速度快。它靠ToolOrchestra训练法,协调工具解题。此赛道已有多项研究,小模型实用优势明显。