「机器学习专家」共找到 2008 篇相关文章
为什么自监督永远学不到语义?
《Visual Language Hypothesis》论文用纤维丛理论审视视觉表征学习,指出只做连续变换难触达语义。分析现有无监督学习不足,提出“Expand - and - Snap”机制,还通过实验验证,提供审视AI架构新视角。
52k Star,Hermes Agent试图杀死OpenClaw
近期龙虾(OpenClaw)热度下降,harmess engineering大火。开源项目hermes-agent已有52.7k Star,是自学习型AI智能体,能积累技能、持续学习,可轻松切换多种模型,还给出安装、使用指南和文档教程。
数据合成有没有未来?事实结论来了
有人认为用大模型合成数据可快速生产,无需人工标注。但作者观察发现人工标注不仅必要且要求更高。以Scale AI、Surge AI为例说明标注价值,还展示‘智能知识’团队对两数据集审查结果,证明高质量数据需专家和管理流程。
吴恩达来信:人工智能工程技能地图
吴恩达团队综合整理AI工程技能地图,助开发者确定学习方向和雇主招聘。四项重要技能为构建和部署AI应用、软件工程基础、使用编程智能体、塑造构建,背后需持续学习心态。
准确率轻松翻倍!不烧钱微调,AI靠“写日记”实现能力跃升
Memento - Skills系统抛弃大量算力微调模型参数的方式,靠读写反思、“写日记”式学习机制,在不改变模型参数下实现能力跃升,在GAIA和HLE基准实验中准确率显著提高。
告别纯奖励试错!二次尝试+反思蒸馏,复杂任务提升81%
美国南加州大学和宾夕法尼亚大学团队提出新训练范式ERL,将「经验学习」引入强化学习,通过二次尝试和反思蒸馏,在复杂任务中性能显著提升,为构建长期自主智能体提供新思路。
姚顺雨署名:大模型「现学现卖」能力首次被系统评估,腾讯、复旦联手发布CL-Bench
腾讯混元团队和复旦大学研究人员联手推出全新基准测试CL - Bench,系统性评估大模型上下文学习能力。测试显示十大前沿模型表现不佳,揭示当前大模型在该能力上的普遍短板,并指出未来四个探索方向。
腾讯助力Deepseek完善DeepEP,RoCE提升100%,InfiniBand提升30%
Deepseek团队合并腾讯提交的代码完善DeepEP,称有巨大速度提升,RoCE提升100%,InfiniBand提升30%。DeepEP是为混合专家模型和专家并行设计的通信库,有多项创新特性,适合现代AI应用。
Embedding黑箱成为历史!这个新框架让模型“先解释,再学Embedding”
来自多高校研究人员推出可解释的生成式Embedding框架GRACE,解决传统文本表征模型黑箱式表征瓶颈。它重新定义对比学习信号,含三个关键模块,训练双模式统一,实验跨任务提升且不损生成能力。
AI 赋能 eBay 支付风控:从用户行为到交易安全的全面智能化|AICon 北京
6月27 - 28日AICon全球人工智能开发与应用大会北京站将举办,eBay高级技术专家魏瑶将分享《AI赋能eBay支付风控》。eBay用AI提升风控能力,也面临挑战并提出方案,大会还有多专题论坛。