「机器学习专家」共找到 2014 篇相关文章
ICCV 2025|UV-CoT:无监督视觉推理新突破,偏好优化重塑图像级思维链
随着文本领域思维链推理机制成功应用,研究者将其引入视觉理解任务。现有模型有局限,本文提出UV - CoT新框架,设计无监督数据生成与偏好优化机制,提升模型能力,摆脱对人工标注依赖。
Kimi K2技术报告正式发布:“保姆级”深度解析,一文读懂万亿参数智能体的所有秘密
Kimi K2技术报告发布,Moonshot团队用万亿+参数稀疏MoE架构等打造接近Claude - Opus的通用大模型。围绕训练稳定性等改进,有预训练、架构设计等多方面创新,为智能体领域提供可行路径。
没有老黄不夸的中国公司了吧??
英伟达CEO黄仁勋访华期间,在高密度采访交流中对中国公司、技术赞不绝口。他夸雷军和小米,评蔚小理、华为、DeepSeek等,还看好中国大模型、机器人等领域,此外也谈及英伟达合作、AI发展等问题。
未来,你的 Agent 怎么付钱?
借 a16z 文章,探讨 Agent payment 领域进展。实现 Agent 自主支付是未来关键方向,现已有迹象且部分企业推出解决方案,但 Agent 处理支付尚未真正自主,还面临角色范围、欺诈、责任归属等难题。
刚刚,NLP先驱、斯坦福教授Manning学术休假,加盟风投公司任合伙人
NLP领域先驱、斯坦福教授克里斯托弗・曼宁从斯坦福休假,加入AIX Ventures任普通合伙人。他是将深度学习用于NLP的早期领军者,著作、课程影响大,此次转型将助力AI初创公司发展。
大模型全员0分!谢赛宁领衔华人团队,最新编程竞赛基准出炉,题目每日更新禁止刷题
谢赛宁等人出题,让o3、Gemini - 2.5 - pro等模型全军覆没。LiveCodeBench Pro是实时基准测试,题库每日更新。此前称LLM编程超人类专家,本次测试并非如此,最好模型难题通过率也为0。
75%预训练数据都能删!Jeff Dean新作:全自动筛除低质量数据
Google DeepMind团队开发的DataRater可全自动评估数据质量,用元学习筛选有价值数据,提升模型训练效率。它能减少计算量、提高性能,在低质量数据集效果佳,还能跨模型规模泛化。
SFT+RL双管齐下:ReasonGen-R1如何破解文生图「指令不遵」难题?
上海科技大学等机构提出 ReasonGen-R1 框架,结合链式推理监督微调与强化学习,提升自回归图像生成模型推理和创作能力,已全面开源。介绍了其训练阶段、实验结果及推理链模式。
Muon作者仅用一篇博客,就被OpenAI看中了
Keller Jordan 2024 年 12 月 8 日发布博客提出用于神经网络隐藏层的优化器 Muon,能提升训练速度。他未发论文,称只信速通。其案例显示 OpenAI 重能力。博客对前沿指标描述或过时,Muon 有诸多实证成果。
从辅助工具到智能决策,大模型如何改变人才选拔方式?
随着大模型应用拓展,企业人力资源管理成落地热点。阿里巴巴技术专家程鹏认为,大模型在人才选拔与培养中有效率、个性化、客观决策等颠覆性价值,也面临落地挑战,还分享应对策略等内容。