3D堆叠技术」共找到 4490 篇相关文章

产品应用7

太牛了~~复杂表格Cell合并、跨页拼接,中文领域96%,甩MonkeyOCR 20%

在PDF文档解析领域,复杂表格解析是难题。今天分享的OCRFlux是基于qwen2.5vl - 3B模型微调的解决方案,有单页解析和跨页段落/表格合并等创新点,测试得分超96%,远超MonkeyOCR等。

PaperAgent
新闻资讯7

苹果分享 iOS 26 即将推出的 AI 基础模型的细节

苹果在技术报告中公布 iOS 26 新 AI 基础模型细节。该模型有 3B 参数和更大版本,前者在设备运行,后者用于私有云平台。介绍了架构、评估结果,还强调实现可信赖 AI 的方法。

InfoQ
开源动态8

全新稀疏注意力优化!腾讯最新超轻量视频生成模型HunyuanVideo 1.5核心技术解密

腾讯混元大模型团队发布并开源轻量级视频生成模型HunyuanVideo 1.5,参数8.3B,支持5 - 10秒高清视频生成。它通过多层次技术创新,在生成效果、性能与尺寸上实现平衡,还具备多种核心能力。

量子位
开源动态8

三大核心创新公开,快手开源多模态Keye-VL 1.5拿下视频理解SOTA,8B力压GPT-4o!

快手开源多模态Keye-VL 1.5,为8B视频理解大模型,公开3大核心创新技术。靠Slow - Fast视频编码等,在20 + 基准屠榜。它能精确视频定位,实验显示通用、视频理解和数学推理表现佳。

CourseAI
开源动态8

登顶行业SOTA的多模态视频生成标杆,昆仑天工刚给开源了

昆仑天工发布的多模态视频生成模型SkyReels-V3正式开源。它能文生视频、图生视频等,效果逼真。该模型针对现有AI视频问题实现多方面技术突破,且昆仑天工在模型和产品层面均有深厚积累。

量子位
开源动态8

三大核心创新公开,快手开源多模态Keye-VL 1.5拿下视频理解SOTA,8B力压GPT-4o!

快手开源多模态Keye-VL 1.5,为8B视频理解最强模型,公开3大核心创新技术。它靠Slow-Fast视频编码等,在20+基准屠榜。在多类基准测试和内部测评中表现优异,将业务经验沉淀到开源社区。

PaperAgent
新闻资讯8

从「悟道」到「悟界」,智源走进大模型的新时代

在2025智源大会上,智源研究院院长王仲远表示大模型技术演进未到终点。会上推出「悟界」系列大模型,包含Emu3、见微Brainμ等,推动AI从数字走向物理世界。还介绍了具身智能成果,且与企业合作打造生态。

AI科技评论
推荐文章7

百度AI+ DeepSeek 豆包等GEO怎么做出排名?5个技巧,附快排与白帽操作区别

文章介绍GEO优化在AI大模型2 - 3天出排名的5个技巧,包括官网SEO梳理、词库挖掘整理、内容数据投喂、市场竞对分析和技术策略微调,还对比快排与白帽GEO服务商,强调合规操作。

白杨SEO优化教程
新闻资讯7

量产倒计时!三星DRAM工艺实现突破

韩媒报道三星电子成功制造全球首款“次10纳米”DRAM工程裸片。其突破源于“4F²单元结构”与垂直沟道晶体管(VCT)两项核心技术协同,还革新材料。三星规划10a DRAM 2028年量产,后续迈向3D DRAM。

芯师爷
算法论文8

Yann LeCun非生成世界模型前瞻:开年三篇论文展示JEPA工程化拐点

2026年Yann LeCun团队3篇论文展示基于JEPA框架的非生成世界模型工程化拐点。Rectified LpJEPA让表示更省力,GRASP将长时域规划并行求解,EB - JEPA把方法写成代码,为非生成式世界模型提供技术路线。

AIGC开放社区