如视Argus」共找到 2004 篇相关文章

算法论文7

全面评估多模态模型频OCR能力,Gemini 准确率仅73.7%

MME - VideoOCR团队评估多模态大模型(MLLM)频OCR能力。构建精细任务体系和高质量数据集,评测18个主流MLLM。即便Gemini - 2.5 Pro,准确率仅73.7%,暴露出MLLM在频OCR领域能力局限。

量子位
新闻资讯7

GPA只有3.3,顶会一作两篇,成功杀进TOP 20 AI博士?小哥曝光关键秘诀

亚洲硕士手握两篇顶会一作,本科GPA 3.3,计划申请2026年秋季AI领域TOP 20博士项目。网友看法不一,有人认为论文更重要,有人强调GPA是筛选因素。关键是进实验室、获大牛推荐信。还提及罗剑岚求学传奇。

新智元
推荐文章7

大模型微调知识与实践分享

文章详细介绍大型语言模型(LLM)微调知识与实践,包括模型结构、参数量等知识,以及Prompt工程、数据构造、LoRA微调等技术点。还给出微调实践流程,介绍相关平台和框架,星云、TuningFactory等。

阿里云开发者
新闻资讯7

被知乎文化所感染的第 1947 天

作者分享在知乎 1947 天的经历,受邀参加知乎第十一届新知青年大会。大会 AI 含量高,探讨多,具身智能、模型发展方向等;社区味浓,形式多样氛围好;还对年轻人友好,鼓励表达畅想。

特工宇宙
产品应用8

英伟达再破世界纪录,每秒1000 token!刚刚,全球最快Llama 4诞生

英伟达用Blackwell创下AI推理新纪录,单节点8颗GPU实现Llama 4 Maverick模型每秒单用户生成1000个token。这得益于技术组合拳,用TensorRT - LLM优化、应用FP8格式等,满足了低延迟需求。

新智元
推荐文章7

5Y View|何打造真正有用的AI产品?生成式AI改变的创业规则

本文围绕何打造真正有用的AI产品展开,以Granola为例,阐述生成式AI领域创业需新打法,不浪费时间解决即将消失的问题、利用边际成本创造机会、重上下文及聚焦特定场景等。

五源资本 5Y Capital
新闻资讯7

OpenAI自曝:AI推理砸钱越多,碾压人类越狠!

OpenAI研究员探讨推理模型时代。Noam Brown强调预训练和推理范式,指出当前AI胜在通用性。推理范式成本低、效果好,o系列模型表现出色。首席经济学家谈AI经济影响,称其重塑企业格局。

新智元
新闻资讯7

最新!OpenAI:GPT-5将实现大统一,Codex最佳实践是这样的

OpenAI Codex在Reddit AMA活动中,核心负责人围绕先推云端代理、GPT - 5与Operator整合等问题给出路线图。Codex - 1预览情况、CLI设计、使用场景、安全模型、接入计费及API生态等方面都有说明。

AI寒武纪
新闻资讯8

图灵奖得主杨立昆现场追问:AI 还没越过这 3 道认知墙,谈什么通用智能?

图灵奖得主杨立昆指出AI未越过三道认知墙,即看不懂物理世界、无长时记忆、无推理结构,提出JEPA架构及AMI概念,还建议别卷模型,应卷架构,探索具身智能等领域。

力学与人工智能
新闻资讯7

PDF文件长出「AI大脑」?网友惊呼:这操作太「黑科技」了!

极客Aiden Bai将大语言模型塞进PDF,可让AI讲故事、聊天,Linux系统也能在其中运行。项目嵌入小型语言模型,TinyStories、Pythia和TinyLLM,利用PDF支持的JavaScript实现,虽有局限但潜力大。

新智元