「视频推理数据集」共找到 4984 篇相关文章

开源动态8

阿里自己上场,用Qwen3做起了SmartResume应用

近期,阿里用Qwen3-0.6B+YOLOv10做了智能简历解析系统SmartResume,Code、Model、Paper都已开源。该系统支持多种文档格式,融合OCR与PDF元数据完成文本提取,结合版面检测重建阅读顺序,并通过LLM将内容转换为结构化字段。

PaperAgent
新闻资讯7

OpenAI单月收入突破10亿美元!算力严重不足,急需“星际之门”

OpenAI首席财务官Sarah Friar透露7月单月收入破10亿美元,因GPT - 5发布和新订阅服务,算力压力大,所以联合投资打造“星际之门”。虽GPT - 5有争议,但订阅用户增长,开发者反馈好。

AIGC开放社区
算法论文8

只需一次指令微调,大模型变身全能专家天团,8B模型性能反超全微调基线 | ACL25 Oral

预训练大模型适应专业领域需高昂微调成本,稀疏混合专家架构虽能提升推理效率,但从头训练耗资源。浙大与Thomson Reuters团队提出SIMoE,单阶段微调就能升级大模型,还解决传统方法两大局限,在性能和效率上双突破。

量子位
推荐文章8

刚刚!北大校友Lilian Weng最新博客来了:Why We Think

北大校友Lilian Weng更新博客《Why We Think》,回顾利用测试时计算的研究进展,探讨让模型“思考更久”的方法。文中介绍了思维链、潜变量建模等策略,还提及多种提升生成质量的策略,如并行采样与序列修订,以及强化学习提升推理能力等内容。

机器之心
新闻资讯8

AI一天写4.4万行代码却没合并,程序员:AI Coding 真正的瓶颈来了

本文分享腾讯AI原生研发的真实案例,指出AI Coding产能提升后,最大瓶颈已非模型能力,而是现有研发治理体系与人的注意力适配问题,同时预告2026奇点智能技术大会的行业实践分享。

AI科技大本营
推荐文章9

GPT-6数学封神,遭顶尖数学家公开质疑“算力截胡”?OpenAI内部研究员撕开Astra真相:人脑更容易被污染,而AI只看概率

OpenAI推出GPT-6 Astra,接连在埃尔德什单位距离猜想、纳维-斯托克斯方程等多个顶级数学难题上取得突破性进展,引发顶尖数学家对学术伦理与传统研究模式的争议,本文为OpenAI内部研究员的深度对谈编译,拆解AI数学推理的核心逻辑。

AI科技大本营
产品应用7

当 Agent 走出 App:WorkBuddy 的朋友圈开始向外生长

9月2日深圳的WorkBuddy生态发布会,展示9款联名硬件,有30多个硬件品牌、30多个Buddy应用、100多个开放平台共创伙伴参与。WorkBuddy开放Agent能力,连接伙伴资源,解决数据和专业经验难题,开放硬件、应用与平台三层,但面临价值分配等问题。

InfoQ
新闻资讯7

突发!Fable 5.1遭黑客破解,27万字提示词泄露

Fable 5.1和Mythos 5.1发布,Fable 5.1推理成本低32%。但发布几小时后被破解,27万字提示词泄露,曝光了其安全限制、隐私保护等秘密。它工具增加,还破解密码、能完成多种任务,不过也有用户抱怨耗token等问题。

新智元
算法论文8

都在卷「让大模型多循环几遍」,这个7B模型LoopCoder v2说:多循环 1 次就够了

当下推理模型流行在测试时多循环,以打磨答案。但新研究发现,7B模型LoopCoder v2只多循环1次(共2次),就能大幅提升性能,继续增加循环次数,性能反而下降。研究还分析了收益与成本,给出选择循环次数的诊断方法。

机器之心
算法论文8

欲取代transformer的SSA(次平方稀疏注意力)解读

文章解读了欲取代Transformer的SSA(次平方稀疏注意力)算法。它支持12M tokens上下文,比fastAttention快52倍,训练和推理更快。SSA改变了注意力扩展特性,有计算和内存线性扩展等特性,经三阶段训练可可靠利用长上下文。

Agent的潜意识