小样本建模」共找到 1407 篇相关文章

算法论文8

ACL 2025 | AI字幕慢半拍,不知道大家在笑什么?新方法让同传性能直逼离线翻译

香港中文大学、字节跳动Seed和斯坦福大学团队提出SeqPO - SiMT框架解决同声传译“质量 - 延迟”权衡问题。该方法将同传建模为序贯决策过程,优化决策序列,实验显示其性能直逼离线翻译。

机器之心
开源动态8

Linear-MoE:线性注意力遇上混合专家的开源实践

近年来,线性序列建模和混合专家(MoE)研究进步大,但两者结合研究少,相关开源实现缺失。上海人工智能实验室团队的 Linear - MoE 首次实现两者高效结合并开源技术框架,实验验证其有诸多优势。

机器之心
开源动态8

蚂蚁具身研究首次亮相!就解决了机器人「看」透明玻璃这些难题,还开源了

蚂蚁灵波科技开源高精度空间感知模型 LingBot-Depth,针对性解决机器人识别真实世界的「玻璃问题」。其构建双线并行数据集,提出掩码深度建模思路,在深度补全等任务中表现出色,且已具备落地能力。

机器之心
算法论文8

告别「盲目自信」,CCD:扩散语言模型推理新SOTA

华为艺香港团队等研究人员提出上下文一致性解码算法(CCD)。它解决传统DLM推理“短视”和采样预算固化问题,在开源DLMs上实现3.48倍加速和3.9%性能提升,适配多种解码设定。

机器之心
新闻资讯7

太酷了!Anthropic 让Claude 开了家店赚钱,却被员工狂薅羊毛,亏到破产……

Anthropic让Claude Sonnet 3.7在办公室经营店,配备网络搜索等工具。Claude因定价失误、好说话等致亏本破产,不过也展现出搜索和适应能力。Anthropic认为AI成中层管理者不远,改进后或不亏本。

AGI Hunt
产品应用7

新版DeepSeek R1你得这样用,太爽啦~

前几天DeepSeek R1悄悄更新,作者测评发现,起初用复杂提示词,它比Claude4有明显差距;换成一句话提示词,生成效果质的飞跃,代码能力大幅提升接近Claude4,写作提升,数学能力提升不大。

开源星探
新闻资讯8

龙虾让位!硅谷顶流AI「爱马仕」一夜闯进微信,冲上全球第一

硅谷新宠Hermes Agent爆火,GitHub揽6.6万星,原生接入微信引开发者关注。其署名的首篇‘顶会级’论文提出Autoreason推理方法,指出传统‘自我优化’弊端,展示出模型逆袭等优势。

新智元
产品应用7

23岁零基础用AI编程月入5000+:一个00后的淘宝变现实战

23岁伙大骏零基础用AI编程,先做图片处理工具在淘宝售卖,后通过私域运营让收入翻3 - 4倍。他分享了AI编程变现经验,强调好奇心、行动力和佛系心态很重要。

AI产品黄叔
新闻资讯7

吴恩达来信:为什么 Meta 会向 AI 工程师支付 1 亿美元薪酬

近期,Meta 因向 AI 模型开发人员提供超 1 亿美元巨额薪酬登上头条。模型扩展资本密集,薪酬占比,且 AI 对 Meta 业务机遇与威胁并存,招聘还能获技术洞察,所以高薪合理。

DeeplearningAI
产品应用8

首个高考数学满分AI诞生!海淀名师审大题,给出惊艳超高分

豆包爱学App的AI挑战高考数学全国卷,经6位资深名师严格把关,获Ⅰ卷144分、Ⅱ卷150分满分。其解题过程出色,虽有问题但可解决,对师生帮助大,预示AI教育将变天。

新智元