「应用生成」共找到 4047 篇相关文章
斩获20K星!再见PDF排版噩梦,这个开源神器让文档处理爽到飞起!
MinerU是上海人工智能实验室推出的开源数据提取工具,能将多模态文档解析为Markdown,支持精准提取图片、表格、公式,具有多语言支持、高性能等特点,应用场景广泛,还开源免费。
Scaling没有墙!Anthropic CEO:AI实验室真相远超公众想象
Anthropic CEO Dario Amodei在摩根士丹利会议称Scaling Law未撞墙,2026年将激进加速。他用棋盘稻米寓言比喻,称当前处第40格,前39格增长只是前奏。还透露代码生成是AI能力爆发指标,Anthropic或在RSI取得进展,且重视人才文化。
面向 AI Agents 的高性能数据基座:架构和工程实践
在 QCon 全球软件开发大会上,晨章数据创始人陈亮分享了面向 AI Agents 的高性能数据基座。他指出 AI Agent 驱动的应用带来数据挑战,提出多模态数据基座设计目标,并介绍工程实践,证明传统架构有 CPU 瓶颈。
AI视频运镜玄学已破!告别无限抽卡,3D预演台直接封神
用AI做视频常遇运镜、人物走位等问题,因文生视频系统缺空间锚定能力。updream在8月17日上线「预演台」功能,通过传参考图自动生成3D白模场景,实测显示其显著减少「抽卡」次数。
AI眼镜不再依赖手机!这次真要单飞了
2026年AI硬件出货量飙升,但操作系统仍受GUI时代旧秩序束缚。乐奇Rokid在Rokid Open Day 2026上提出AIOS原生智能眼镜操作系统及AIUI交互标准,重构YodaOS,还搭建应用商店,构建开放生态。
LabVLA:当AI走进科学实验室,浙大x上海 AI Lab联合探索科学具身智能
浙江大学与上海人工智能实验室联合推出 LabVLA,探索更具泛化能力的科学具身智能范式。团队构建仿真数据引擎 RoboGenesis 与语料 LabEmbodied - Data,LabVLA 在多测试中表现良好,还将探索多场景应用。
只看图片就能学会压缩Token!浙大&阿里新框架多轮VQA压缩率90%,精度不掉|CVPR 2026
多轮视觉问答成LVLM推理效率“照妖镜”,现有压缩方法在多轮场景翻车。浙大宋明黎教授团队与阿里联合提出MetaCompress框架,可根据图像生成最优压缩映射,实验验证其效果优,能平衡压缩率与精度。
AI时代,最老的设计哲学反而最有效
50年前的Unix哲学‘万物皆文件’和‘文件夹即应用’正以意想不到的方式回归。过去因‘人类可理解性’被推崇,如今因AI能操作而重获重要性,文件夹成‘智能空间’,AI成其操作系统。
170次搜索+50次反思:用GLM-4.7盘点2025 Agent行业趋势,结果太震撼!
作者给智谱新开源的GLM - 4.7布置调研2025年Agent赛道企业的任务,结果令人震撼。该模型进化显著,能整理详细企业信息,还能生成高审美PPT。国内有不少特色AI落地企业。
腾讯胡文博:引领 3D 视频世界模型新趋势丨GAIR 2025
2025年12月12 - 13日,第八届GAIR全球人工智能与机器人大会将在深圳举办。腾讯ARC实验室高级研究员胡文博将在13日《世界模型》论坛分享《迈向三维感知的视频世界模型》。他深耕视频生成模型,成果显著。