「开源数据集」共找到 5069 篇相关文章
1B参数,0.21秒识别,0.3%错字率:混元OCR拿下7项SOTA
腾讯开源模型 HunyuanOCR 在权威榜单 OmniDocBench 上霸榜,虽仅 1B 参数,却在 7 项任务击败众多大模型。它解决传统 OCR 流水线及通用大模型痛点,通过独特架构和训练方法实现高效准确识别。
多家芯片公司业绩飙涨,这个赛道彻底火了?
近期多家A股芯片公司Q3财报亮眼,受益于端侧AI推进。端侧AI优势多,吸引科技巨头布局,但落地有挑战。技术进步使大模型轻量化,手机与AI眼镜较热。其发展面临应用、技术、生态等问题,也有隐私保护方案。
一个能思考、会记忆的AI导演诞生了!新加坡管理大学,香港中文大学等实现故事化视频生成
新加坡管理大学等提出开源全能多智能体框架UniVA,可统一视频理解、分割等能力,按指令生成完整故事视频。还引入UniVA - Bench基准测试套件,实验显示其在多任务中表现出色,代表视频智能生成重要进步。
模型即智能体,Kimi K2 Thinking多项评估超越顶尖闭源模型,300轮工具调用不疲倦
月之暗面发布Kimi K2 Thinking,它是Kimi迄今最强开源思考模型,基于模型即智能体理念训练,可自主连续工具调用与多轮思考,多项评估超顶尖闭源模型,还实现原生INT4量化,提升生成速度。
重生之在《我的世界》做山姆·奥特曼:网友在线手搓ChatGPT
一老哥在《我的世界》上手搓出有500万个参数的ChatGPT,经英语对话训练,能在像素世界小电脑上对话,用红石电路和存储单元搭建,未用指令集,网友还在游戏里开发出诸多东西。
深度讨论 Online Learning :99 条思考读懂 LLM 下一个核心范式|Best Ideas
文章围绕Online Learning展开深度讨论,指出其或为LLM下一个核心范式。探讨了它是通往更高层次智能的关键路径,分析概念定义、非共识,还阐述做好它的方法,以及架构、算力和评估范式等问题。
ChatGPT推出即时结账,比Claude发布重要得多
OpenAI宣布在ChatGPT推出即时结账功能,用户可在聊天界面直接购买,首批合作商家有Etsy,Shopify超百万商家将加入。由ACP驱动,是开源标准。资本市场反应好,社区反应不一,这标志AI助手向交易平台转变。
对话 Plaud 莫子皓:你还记得 PMF 的感觉吗?
本文是对Plaud中国区CEO莫子皓的采访。Plaud是全球成功的AI硬件Startup,产品大卖。莫子皓分享业务、增长原因,探讨PMF、产品形态迭代、功能亮点,还谈及产品定位、人群、未来计划及进入中国市场决策等。
他,37岁华裔,靠AI成为福布斯400最年轻亿万富翁,身价180亿美金!
37岁华裔Edwin Chen成《福布斯400》最年轻亿万富翁,身价180亿美元。他拒绝VC融资,用积蓄打造估值300亿美元的AI数据标注公司Surge,希望让AI学会「人类的复杂性」,还担忧AI模型被错误优化。
OpenAI 内部是怎么使用 Codex 的.pdf
文章基于对 OpenAI 工程师的采访和内部使用数据,汇总了 Codex 在 OpenAI 内部的使用案例和最佳实践。展示其在代码理解、重构迁移等七大场景的应用,还给出使用的最佳实践,认为未来潜力大。