「开源数据」共找到 4920 篇相关文章
面对无解问题大模型竟会崩溃?港中文&华为联合提出首个大模型推理可靠性评估基准
港中文和华为诺亚实验室联合提出ReliableMath基准,探究大模型推理可靠性。提出评估准则,构建含可解与不可解问题的ReliableMath数据集,实验揭示大模型缺陷,还提出提高可靠性的对齐策略。
如何将LLM的"思考习惯"迁移到视觉领域?
传统多模态模型处理复杂视觉推理能力不足,OVR团队以Qwen2.5 - VL - 7B为基础构建开源强化学习框架,成果模型OVR在12个基准测试刷新记录,揭示认知行为跨模态迁移三条黄金定律。
Qwen3.8-Flash:全新架构,更强更稳更划算
本文介绍了 Qwen3.8-Flash 多模态 MoE 模型,它原生支持 262,144 token 上下文。该模型在 Attention、Residual、Embedding 与 Optimization 四个方面系统升级,降低训练与推理成本,即将上线千问 AI 平台。还发布了 Qwen3.8-Flash-Next 开源权重。
超700人预约,昆明一门店免费安装!不少线下数码门店迎来大量用户,“小龙虾”火爆出圈!
一款名为OpenClaw的AI智能体因图标是红色卡通龙虾被称为“小龙虾”而火爆。昆明线下数码门店有用户咨询、预约安装,超700人预约。它能自动完成操作,但存在技术门槛和数据安全风险,国家相关部门已发布提示。
AI能否「圣地巡礼」?多模态大模型全新评估基准VIR-Bench来了
来自日本高校和企业团队提出多模态大模型评估基准 VIR-Bench,用于评测 AI 对旅行视频中地理位置与时间顺序的理解。它将任务拆解,构建数据集,实验显示模型虽有改进但性能远未达标,指明了大模型进化方向。
Ilya的首个模型来了!
掌握内幕的草莓哥爆料,Ilya正构建以TTT为核心的小型推理引擎。他预见传统大模型的死穴,SSI将TTT概念落地,其引擎在数据效率等方面优势明显。SSI获投资,本月或发新模型。
开发者冲爆了!全球前十AI Lab无限免费,一周烧出3.12万亿Token
6月1日,全球模型榜单前十的Agnes AI无限期免费开放旗下核心全模态模型API,引发开发者热情。两周后周调用量达3.12万亿Token,本周还将升级,周五补齐语音全模态链路,开源社区也围绕其开展诸多项目。
蛰伏一年,周衔团队带来首个具身基础模型,烹饪做实验弹琴,效果炸场
Genesis AI公布首个机器人基础模型GENE - 26.5,能完成烹饪、解魔方等复杂任务。该模型是全栈系统,以仿真加速迭代,用自研手套采集数据,还重写控制栈。公司后续计划发布全身机器人。
Agent新王诞生!Hermes 7周追上龙虾,中国用户可微信直连
2026年二季度,Hermes Agent成新潮流,由美国Nous Research开源,其GitHub stars数达84.4k。国内云厂商支持部署,手机厂商接入并限免。它原生支持微信,开发者评价高,与OpenClaw双雄并立,正掀起生产力革命。
养虾人狂吃国产模型!4.19万亿Token调用量激增34.9%超越美国
根据OpenRouter数据,上周中国大模型周调用总量飙升至4.19万亿Token,再度超越美国登顶全球。中国产品在全球大模型调用量Top 5中占三席,国产大模型受青睐,但在速度和价格方面仍待提升。