「数据增强」共找到 2784 篇相关文章
arXiv创始人亲测:水论文这一块,Grok最强,Claude最不配合
Nature报道arXiv创始人Paul Ginsparg牵头的研究,测试13个主流大模型在用户要求造假水论文时是否拒绝。结果Claude最守底线,Grok和ChatGPT较易“配合”,多轮对话中模型易动摇,论文激增危害多。
训练机器人方式对了吗?英伟达DreamZero双榜第一新反思
NVIDIA的DreamZero在RoboArena和MolmoSpaces基准测试双登顶。分析文章《Why is DreamZero so good at robotics?》从多维度拆解其表现突出原因,质疑传统认知,如数据量并非万能,模型规模和信息输入方式也很关键。
AI甚至开始抢土木老哥的工作了
即便土木、建筑等传统行业,也受AI冲击。建筑业用AI克隆老师傅、替代部分人力,如Procore推出多款AI智能体,Skanska建立AI安全智能体。建筑AI生态矩阵正形成,国内需相关工具。
阿里Qwen-Image-2.0图像生成与编辑巅峰汇合,超真实、超强图文结合
阿里Qwen - Image - 2.0将生图与编辑能力合二为一。它支持长指令,能精准渲染大量文字,引入物理逻辑让文字呈现真实质感,在生图和编辑上对语义理解和画面重构能力强。
一个大脑搞定所有模态,百度ERNIE 5.0技术报告公布
模型发布近3个月后,百度ERNIE 5.0技术报告公布。其底座用超级稀疏架构,参数量万亿但推理激活参数不到3%,实现四种模态原生自回归统一,还在路由调度、训练范式等多方面有创新。
开源版 Claude Cowork
Multica是原生桌面客户端,将编程智能体能力带给大众,支持Claude Code等。它类似Obsidian,可按需定制,能解决编程智能体使用障碍,具备简洁界面等特性,还介绍了使用、开发、构建等内容。
2025小结:从RL到Agentic RL
作者回顾2025年从RL到Agentic RL的发展,指出Agentic RL存在慢、不稳定、难scale的问题,还探讨了RL与推理、CoT的关系,以及RL的泛化能力,认为RL能提升模型能力但还不稳定,期待明年研究。
4D通用世界模型!中科院NeoVerse用百万单目视频直接构建
中国科学院自动化研究所与CreateAI团队构建4D世界模型NeoVerse,它用全新端到端架构,从单目视频高效重建4D高斯泼溅,模拟成像退化提升生成鲁棒性,在多任务表现卓越。
The Batch: 892 | 教育应与 AI 协作,而非对抗
三年多前ChatGPT发布,教育改变。曾寄望用AI检测器识别生成文本,但学生易规避。检测难维持信任,还可能惩罚错对象。生成式AI可提升学习,应构建新评估模型,如展示真实理解等。
ChatGPT也上线了个人年度报告!
OpenAI 让 ChatGPT 上线「Your Year with ChatGPT」功能,根据用户过去一年对话生成专属年度回顾。报告有数据统计、聊天风格分析、年度奖项等,还能预测 2026 年,虽简洁但数据更私密真实。