「证据标注」共找到 185 篇相关文章
开源8300小时标注数据,新一代实时通用游戏AI Pixel2Play发布
随着AI在代码和图片生成领域成熟,研究人员开始关注其在游戏领域的表现。此前的专用模型缺乏跨游戏泛化能力,通用模型在游戏环境中表现不佳。为此,Player2研究员提出Pixel2Play模型,还开源了代码和数据集。
88天登录193次!顶级证据+循证医学,让500万中国医生拥有「神助攻」
国内医生面临高负荷工作与医学知识快速更新的挑战,通用大模型在医学场景中存在高幻觉率问题。阿里健康推出医学AI产品「氢离子」,具备低幻觉、高循证特点,有四层循证架构,还与多方合作构建数据壁垒。
再不怕乱引文献!绕过付费墙,BibAgent把学术核验转为证据链
大模型生成学术论述,其引用验证成难题,尤其付费墙后论文难以核验。BIBAGENT突破此困境,不破解付费墙也能验证引文语义真伪,还构建MISCITEBENCH评测,表现优异,为科学写作补“可审计基础设施”。
无需人工标注!AI自生成训练数据,靠「演绎-归纳-溯因」解锁推理能力
新加坡国立大学等机构研究者提出元能力对齐训练框架,模仿人类推理心理学原理,将演绎、归纳与溯因能力融入模型训练。实验显示,该方法提升模型在多任务上的性能,且有跨领域可扩展性。
0 融资、10 亿美元营收,数据标注领域真正的巨头,不认为合成数据是未来
Surge AI创始人Edwin Chen接受访谈,提出创业应解决问题而非融资,合成数据被高估,高质量数据才是壁垒。他还指出大语言模型竞技场误导训练方向,人类反馈永不过时,数据质量是AI发展首要瓶颈。
CVPR 2026|用互联网视频替代3D标注:通研院团队打造SceneVerse++「最大规模」真实3D场景数据
北京通用人工智能研究院团队在CVPR 2026接收论文中,提出自动化数据引擎,用互联网视频构建SceneVerse++数据集,规模超现有同类,在3D检测、VQA、VLN任务提升性能,还指明3D空间智能发展方向。
大模型学会拖进度条看视频了!阿里新研究让视频推理告别脑补,实现证据链思考 | ICLR 2026
阿里巴巴未来生活实验室团队解决多模态大模型视频推理难题,推出ReWatch数据集和ReWatch - R1模型。数据集克服现有训练数据痛点,模型用SFT + RL范式及创新奖励机制,实验成绩SOTA。
开源啦,1天交付,报价翻5倍,接私活要电子签功能?我把"印章+证据链"封装成可二开底座
作者小华分享开源项目Mini Contract.Pro,这是电子签开源底座,解决印章、落章、签署、存证等难题,有双模式引擎,采用新技栈,结合AI提效,还给出电子签需求硬指标清单。
从写清 Spec 到看懂功能:在 Session 历史中使用 Routa 重建需求全景
文章指出在AI Coding中,Spec负责定义需求起点,大量实现走向内容留在Agent的session历史里。介绍了如何通过Feature Explorer将Spec和Session历史重新组织,让Agent基于功能证据分析,使项目保持整体性。
电商上演「魔法对轰」:卖家用AI假图骗下单,买家拿AI烂水果骗退款
电商领域,卖家用AI假图骗下单,买家拿AI假图骗退款,双方上演“魔法对轰”。单一证据易伪造,平台探索技术和策略组合,建立统一数字内容标准或成破局关键。