「大模型开发」共找到 10200 篇相关文章

推荐文章8

吴恩达开新课教OCR!用Agent搞定文档提取

随着AI大模型发展,OCR重新成为技术专项,DeepSeek、智谱、阿里千问和腾讯混元等都在研究。吴恩达开新课,提出智能体文档提取(ADE)方案,准确率达99.15%,还给出本地和云端部署线路。

量子位
新闻资讯7

Meta超级智能实验室重组为四个部门,某些高管将离开

据《彭博社》报道,Meta 将重组超级智能实验室及相关 AI 部门为四个新部门,某些高管预计离职。Meta 此前大力挖角,此次或从依赖内部开发转向集成第三方模型,扎克伯格强调对超级智能的推动。

机器之心
开源动态7

Kimi K2发布两天即“封神”?80%成本优势追平Claude 4、打趴“全球最强AI”,架构与DeepSeek相似!

国内独角兽月之暗面发布开源模型 Kimi K2,推出两天就在 OpenRouter 超越 xAI 的 Grok 4。它成本优势大,能力泛化和实用性强,编码、Agent 工具调用等方面表现出色,架构与 DeepSeek 相似。

AI前线
推荐文章7

The Batch: 893 | 从预测到执行

2026 年 AI 研究应认识到能预测的模型不等同于能行动的系统。过去十年在被动预测和生成建模成就非凡,但现实任务需系统执行一系列动作。转向长周期任务和目标导向 AI 系统有两大好处。

DeeplearningAI
开源动态8

从VLA到RoboOmni,全模态具身新范式让机器人察言观色、听懂话外音

复旦大学等联合推出全模态端到端操作大模型RoboOmni,统一多模态,实现动作与语音协同控制。它重新定义机器人交互范式,让机器人具备“察言观色”能力,还构建了OmniAction数据集,实验表现全面领先。

机器之心
推荐文章7

万字长文图解Qwen2.5-VL实现细节

文章作者今年年初写好,为防盗版一直内部分享,时隔半年因Qwen2.5-VL已渗入MLLM开发各场景而公开。从源码抽图例助理解,涵盖window attention等内容,排版全文见指定链接。

GiantPandaLLM
新闻资讯7

OpenAI关停Sora!25个月从封神到退场

OpenAI宣布关停Sora,其曾风光无限,从2024年发布技术预览到2025年Sora 2上线火爆,后因国产模型突破、版权危机热度退潮。此举是战略调整,为筹备IPO聚焦商用与代码开发。Sora败退,AI视频进入‘中国时间’。

量子位
算法论文8

ICML 2026 | 拒绝盲目猜token,阿里x浙大将投机解码带入弹性预算时代

随着大模型参数规模扩大,推理成本成核心瓶颈。投机解码在高并发下有问题,阿里与浙大学者提出 ECHO,将投机树构造建模为预算调度问题,通过稀疏门控和弹性预算调度提升系统收益。

机器之心
新闻资讯7

苹果向英伟达生态妥协了!MLX框架主动适配CUDA

苹果特意为端侧AI模型训练推出的MLX框架,主动增加了CUDA支持。因CUDA在AI开发领域占主导,且生态强大,苹果此举是借力英伟达生态、扩大自身影响力的战略选择,也避免侵权。

量子位
算法论文8

单向VLM变双向!人大斯坦福等提出MoCa框架:双向多模态编码器

人大、斯坦福等机构提出MoCa框架,将单向视觉语言模型转化为双向多模态嵌入模型。它通过持续预训练和异构对比微调,解决传统模型局限,在多模态基准测试中表现优异,尤其小规模模型性能突出。

新智元