「预训练数据」共找到 3967 篇相关文章
分析1.8亿份招聘数据后,他告诉你AI究竟取代了哪些工作
本文分析1.8亿份全球招聘信息,发现AI不是造成大规模失业主因,影响因岗位而异。创意执行类岗位下降多,AI基建岗位增长,程序员、客服、销售较稳定,高层受冲击小,还给出评估岗位安全的建议。
如何让AI写出高质量的数据分析报告?DataV-Note的评估体系揭秘
本文围绕DataV - Note智能分析创作平台评估体系建设展开,指出智能工具缺乏统一评估标准等问题。介绍评估模型目标、设计、标准,采用纵向和横向评估方式,还提及未来接入自动化和提升准确度的规划。
Agent全自动搭建代码运行环境,实时更新解决评测过拟合/数据污染问题|微软
长期以来主流代码修复评测基准SWE - bench问题多,制约AI模型能力展现。微软发布SWE - bench - Live,引入新Issue,实现环境自动化构建与更新,打破传统局限,还揭示传统基准过拟合问题。
拒绝Reward Hacking!港科联合快手可灵提出高效强化学习后训练扩散模型新范式
使用强化学习微调扩散模型时,常面临Reward Hacking和KL正则化阻碍探索收敛的问题。港科等团队提出GARDO框架,通过门控自适应正则化和多样性感知优化,解决痛点且全面开源。
首个英文原生「弱智吧」!逻辑谬误数据集与生成框架来了 | AAAI'26
研究发现大模型判断逻辑谬误易误报正常句子,但分类能力较强。研究人员构建英文逻辑谬误基准SMARTYPAT - BENCH,开发生成框架SMARTYPAT,为大模型逻辑评估提供新思路,可用于多领域。
AIAA J | 香港理工大学王旭等:目标导向的特征提取-以特征构建增强数据驱动模型
该论文通过对比学习理清潜在输入特征与目标输出的关联性,提出输出驱动的输入特征构造方法。所构造特征在高维代理模型构建中增强效果显著,还可减少预测误差分布及不同模型收敛性和鲁棒性差异。
狂涨 17.7K star!!智能查询导入、数据可视化、AI 迁移,这款开源数据库图表工具火了!
日常开发中,数据库设计和管理工作繁琐易出错。本文介绍超实用开源项目 ChartDB,它能将数据库结构可视化,AI 帮导出 SQL,有一键导入、AI 驱动导出等特性,开源免费,多种方式安装。
推荐大模型来了?OneRec论文解读:端到端训练如何同时吃掉效果与成本
随着AI发展,推荐系统面临诸多问题,快手技术团队提出OneRec,以端到端生成式架构重构推荐系统全链路,在效果与成本上实现突破,已在快手双端服务用户,也有需完善之处。
4个月融进1亿美元、建齐3座「数据发电厂」,这家TechBio要造一个生物世界模型
原生AI TechBio公司寻明生科4个月融1亿美元,欲搭建横跨数字与生物世界的药物发现基础设施。其聚焦抗体药物设计,构建干湿实验闭环,推出AuraIDE和OpenDDE,采用“既卖引擎,也卖车”商业模式。
突破视觉仿真算力瓶颈!新一代具身智能仿真框架开源:高吞吐并行高保真渲染助力规模化训练
具身人工智能向以视觉为中心转型,但面临“看得真”和“训得快”难题。清华大学智能产业研究院等提出GS - Playground通用多模态仿真框架,融合高吞吐量并行物理仿真与高保真视觉渲染,成果被RSS 2026录用,将开源。