统一表示学习」共找到 2047 篇相关文章

开源动态7

以小博大,仅1.7B媲美gemini2.5-pro,达到SOTA文档解析性能

dots.ocr是多语言开源文档解析器,把布局检测和内容识别统一在视觉语言模型中,虽LLM仅1.7B参数,却达SOTA性能。介绍了其预训练三阶段及SFT阶段关键策略。

PaperAgent
新闻资讯7

一场实战派圆桌实录:解码严谨行业智能体落地的硬核突围|甲子光年

2025年7月28日,在世界人工智能大会相关论坛的圆桌对话里,来自不同行业的实战派探讨企业级AI智能体落地。他们分享落地踩坑经验、应对数据等问题的办法,还预测了未来智能体大规模应用的行业。

甲子光年
产品应用8

国产AI首次「长出」原生记忆,非Transformer架构成新王!机器狗当场引爆WAIC

WAIC世界人工智能大会上,国产黑马RockAI的大模型Yan 2.0 Preview亮相,可多终端无损部署。它基于非Transformer架构,训练效率高,有原生记忆,实现端侧AI,展现出自主学习和多模态能力,引发关注。

新智元
产品应用8

让大模型“跑”在手机里:vivo蓝心端侧部署创新揭秘,性能功耗双优!

在AICon2025上海站,vivo AI研究院工程师章苏迟分享蓝心大模型端侧部署方案。介绍端侧大模型优势及应用场景,阐述内存、性能、功耗等指标优化方法,还提及多业务场景应对策略与安全合规措施。

InfoQ
新闻资讯7

突发!Jason wei也被小扎挖走了

Jason wei是OpenAI研究科学家,是思维链、强化学习研究重要推动者,2023年2月加入OpenAI,此前在谷歌大脑工作。他和HYUNG Won Chung一同被小扎挖走,二人是o系列模型及测试时间计算重要推动者。

AI寒武纪
新闻资讯7

Kimi新模型数学反超DeepSeek!北大校友刘征瀛等领衔

Kimi新定理证明模型超越DeepSeek,基于Qwen2.5 - 72B打造,采用Kimi k1.5强化学习训练流程。有两大技术创新,还有精简版本,官方有Demo。双方此前比赛就打得有来有回。

量子位
推荐文章7

小目标检测难点分析和解决策略

文章基于24年综述论文,分析小目标检测难点,如特征不足、难区分背景等,还给出主流改进方法,涉及数据增强、特征提取、特征融合、损失函数、训练策略等方面,介绍多种算法及效果。

机器学习AI算法工程
新闻资讯7

微软强塞AI暴涨价!小哥惨遭Office全家桶绑架,每月含泪打钱一次未用

最新调查称仅8%的人愿为AI买单,科技巨头却将AI硬塞进日常软件。外国小哥Ted Gioia吐槽被微软AI全家桶绑架,付费却未用。巨头此举或为掩盖亏损,Meta还计划激进推AI,而ChatGPT将上线新功能。

新智元
产品应用7

南京艺术学院人工智能与计算机视觉算法创新设计成果展示

南京艺术学院‘人工智能与计算机视觉算法创新设计工作坊’汇集师生与专家成果,涵盖多种艺术形式。学生学习多技术完成跨媒体作品,如以《大闹天宫》为蓝本的交互装置,还有探索情绪、文化等主题的作品。

MANA新媒体艺术站
算法论文8

LeCun发布最新世界模型:首次实现16秒连贯场景预测,具身智能掌握第一视角!还打脸用了VAE

LeCun团队推出PEVA模型,让具身智能体学会人类“预判能力”,首次实现16秒连贯场景预测。它结合结构化动作表示与条件扩散Transformer,用真实数据训练,解决长时序问题,还能筛选最优动作。

量子位