「全栈式方案」共找到 2537 篇相关文章
“扁平+拓扑”双索引,85页PDF"秒级"推理,MMRag幻觉率骤降76%
文章聚焦多模态长文档视觉问答,介绍现有LVLM - based和RAG - based技术路线及困境。提出MMRAG - DocQA方案,引入‘分层索引 + 多粒度检索’,设计双索引建模相关性与依赖,用互补策略实现证据互补。
郎园Station Events | 官宣定档!第九届初心榜青年视听展10月17日-18日首创·郎园Station见!
第九届初心榜青年视听展定于2026年10月17 - 18日在首创·郎园Station举办。此次展会全面升级,打造“1+1+1+N”矩阵,全产业链力量将共探AI时代视听行业新机遇。报名通道已开启。
Google Gemini Embedding2:一个模型处理所有媒体类型
Google发布Gemini Embedding 2,首个原生多模态嵌入模型。能处理文本、图像等多种媒体类型,支持交错输入,覆盖超100种语言。与多模型串联方案比,延迟降70%、召回率升20%。已可在Gemini API等使用。
首个千万美金ARR的AI4S公司,完成AI设计新分子商业应用
2026 年初,AI 从「单一工具赋能」转向「场景深度共生」。MetaNovas 携 Agentic AI 先进材料发现平台亮相,以创新模式打破传统研发瓶颈,完成从「AI 设计」到「AI 落地」跨越,实现千万美金 ARR。
这届MWC真成了中国AI主场,小米直接把AI从对话框里拽出来接管物理世界了
全球AI竞争从技术探索进入应用兑现期,中国凭场景、数据和硬件生态领跑。小米在MWC展示人车家全生态,用顶尖AI能力和10亿级生态让AI走出屏幕,实现空间智能,率先占位全球竞争。
吴恩达开新课教OCR!用Agent搞定文档提取
随着AI大模型发展,OCR重新成为技术专项,DeepSeek、智谱、阿里千问和腾讯混元等都在研究。吴恩达开新课,提出智能体文档提取(ADE)方案,准确率达99.15%,还给出本地和云端部署线路。
摩尔线程科创板IPO注册获批
10月30日,摩尔线程科创板IPO注册获证监会许可,是科创板‘1+6’改革后高效完成注册的硬科技企业。其从受理到过会仅88天,构建智算产品线,夸娥万卡智算方案优势明显。
面向UE5的智能数字人系统
GMTalker是光明实验室媒体智能团队为虚幻引擎5.3打造的智能数字人系统,集成多种能力,适用于科研等场景。具备多功能特点,与其他开源方案对比优势明显,还介绍了环境要求、启动方式、配置、API等。
零GPU,世界第一超算!深圳制造改写游戏规则了
中山大学教授带队、深圳制造的灵晟超算登顶全球超算TOP500榜单,零GPU采用纯CPU架构,全链路自研。图灵奖得主评价其为“AI4S新型架构的希望之光”,还在多领域展开应用。
大模型能“原地”改参数了!字节Seed&北大新论文:测试时推理无需加层重训练
字节Seed和北大研究团队提出In - Place TTT方案,让大模型能“原地改参数”。它复用Transformer的MLP模块,解决现有TTT架构不兼容、计算效率低和优化目标不匹配问题,实验证明可提升模型长文本任务表现。