数据集构建」共找到 4069 篇相关文章

算法论文8

对噢!为什么LMs就不能直接输出答案+confidence呢?

当前语言模型在复杂问答任务中存在校准退化问题,本文提出RLCR方法,将概率校准融入RL训练目标,重构奖励函数,在多个数据实验中显著降低校准误差,不损失准确性,为高风险场景AI部署奠基。

深度学习自然语言处理
开源动态8

多模态长文本理解测评首发:46款模型无一攻克128K难关

香港科大等研究者联合提出MMLongBench,用于评估多模态模型长文本理解能力。它覆盖5大类型任务的16个数据,对46个模型测试显示,闭源和开源模型在长上下文任务均面临挑战,OCR和跨模态检索能力是瓶颈。

量子位
推荐文章7

6个做AI和ML的奇技淫巧

作者整理了6个做AI和ML的技巧,如提前结束评估、超参数过度优化、精心挑选数据等,指出现在90%的模型可能都用到其中不止一招,还介绍了自己用AI采资讯发布到知识星球。

AGI Hunt
产品应用8

SDD-RIPER 团队落地指南:如何让整个团队在一周内跑通大模型编程

文章提供了 SDD - RIPER 团队落地方案,能让团队一周内跑通大模型编程,质量可控、效果可量化。阐述了推不动大模型编程的痛点及 SDD - RIPER 的解决办法,介绍了部署、实操流程和试点 SOP,还给出效果数据与常见问题解答。

阿里云开发者
新闻资讯7

三季度,光刻之王“满血复活”,台积电成“AI印钞机”

日前,荷兰光刻机巨头ASML发布三季报,净销售额等数据亮眼,其预计四季度业绩更优,但2026年在华销售额或下降。同时,AI浪潮重塑芯片投资结构,ASML投资Mistral AI。台积电Q3营收、利润暴增,也面临依赖北美市场等问题。

芯师爷
开源动态8

英伟达&MIT等推出Long-RL,长视频训练速度翻倍

英伟达联合MIT等推出Long - RL,它是面向长序列推理和多模态强化学习的全栈训练框架,能提升RL训练数据长度上限,让训练速度翻倍。其核心MR - SP并行框架可降低训练耗时和显存,LongVILA - R1是其明星应用。

机器之心
新闻资讯7

星海图高继扬:具身智能下半场,应用为王

星海图CEO高继扬在AGI Playground大会分享具身智能观点,认为2026年是下半场,核心是应用。具身智能发展慢因缺高质量数据和合适本体,未来产品形态或为‘整机+预训练模型+后训练工具’,下游将形成大生态。

Founder Park
产品应用7

我用“悟空”做了应聘和OPT Skills,预测上班和创业成功率丨龙虾OPT创业笔记

钉钉发布全球首个企业级 Agent 平台“悟空”,它是AI产品进入下一个时代的探索,能接入多平台真实数据,操作公司流程。通过开发者应聘、跨境电商、知识博主等场景案例,展现其能力,还能预测创业成功率,解决企业使用AI的安全痛点。

鲸选AI
产品应用7

DeepSeek V3.1 领衔,万字长文CodeBuddy AI Coding 企业落地实践思考

文章结合腾讯CodeBuddy IDE工具,为企业AI CODING落地提供指南。先诊断团队研发流程痛点,给出解决思路;介绍选择AI CODING工具的考量因素及CodeBuddy特色;阐述落地实践问题与应对,构建工作流,还提及使用价值、心得、产品思考与未来展望。

腾讯技术工程
推荐文章8

用系统架构思维,告别“意大利面条式”系统提示词

本文作者分享编写系统级提示词经历,指出‘规则清单式’设计有规则打架、维护难、价值稀释问题。引入系统架构思维,构建四层设计框架,给出编译原则与模板,还重构‘AI编程助手’提示词,实现从‘规则管理者’到‘系统设计师’转变。

阿里云开发者