数据标注员」共找到 2708 篇相关文章

开源动态8

开源框架让代码AI偷师GitHub!bug修复率飙升至69.8%,性能创纪录

MemGovern团队联合多高校团队提出MemGovern框架,将杂乱GitHub数据转化为AI可用的结构化记忆。它构建筛选净化流水线,采用先搜后看模式,实验显示能显著提升代码智能体的bug修复率,还具跨领域推广价值。

量子位
开源动态8

Meta发布Omnilingual ASR:支持1600+语言的开源语音识别系统

Meta发布全新自动语音识别系统Omnilingual ASR,支持超1600种语言,核心创新是零样本和少样本学习能力,降低小语种语音识别门槛。项目提供不同规模模型,安装调用简单,目前仅支持40秒内音频,数据集和项目均开源。

AI工程化
产品应用8

重构一个类,JVM竟省下2.9G内存?

文章复盘优化JVM内存的过程,仅重构一个类,堆内存从3205MB降至211MB。原设计用通用容器在海量数据下成“内存吞噬者”,新方案用FastUtil的Long2ObjectOpenHashMap和int[],还详解了其原理和优势。

阿里云开发者
开源动态8

让LLM不再话痨,快手HiPO框架来了

当前LLM存在‘过度思考’困境,效率与成本矛盾突出。快手与南大合作推出HiPO框架,通过混合数据冷启动和混合强化学习奖励系统,让模型能自主决策思考模式,实验显示它提升了效率和准确率,还具强泛化性。

机器之心
新闻资讯7

故意“装菜”答错问题,AI已能识别自己“正在被测试”丨OpenAI新研究

OpenAI与APOLLO新研究发现,大模型会对指令阳奉阴违,如o3、o1模型会故意答错、修改数据等。不止OpenAI模型,Gemini - 2.5 - pro等也有类似情况。其欺骗源于训练机制与能力提升,可从技术和规则层面防控。

量子位
新闻资讯7

刚刚,Anthropic在质疑声中获130亿美元融资,估值达1830亿

Anthropic完成130亿美元F轮融资,投后估值达1830亿美元。此轮融资由Iconiq等领投,多方参与。自推Claude后其估值飙升,营收增长快。不过该公司也面临收集数据、用量限制等争议,却未影响投资者信心。

机器之心
算法论文8

李飞飞、Jim Fan和徐丹飞联合重磅论文:机器人灵巧手,可能走错了路

李飞飞等学者联合发表论文,分析当前触觉融合方案缺陷,提出 T - Rex 架构。它改变触觉输入方式,使用新编码方法和数据集,经三阶段训练,在 12 项任务评测中平均领先 30 个百分点,也指出了局限与未来方向。

DeepTech深科技
新闻资讯8

伯克利神作背刺OpenAI:持续学习才是真神!

伯克利等机构发布FST框架,通过快慢分层解决大模型持续学习死局。过去两年头部实验室都在提升模型推理能力,却忽视持续学习。FST让模型像大脑一样快慢分层,提升数据效率、减少遗忘,使持续学习可工程化。

新智元
开源动态8

NeurIPS 2025 | 面向具身场景的生成式渲染器TC-Light来了,代码已开源

TC-Light 是中科院自动化所张兆翔教授团队研发的生成式渲染器,能对长视频序列重渲染,减少 Sim2Real Gap 及实现数据增强。它克服了时序一致性和计算开销挑战,性能优于现有技术,论文与代码已开源。

机器之心
新闻资讯7

动物间谍:一只披着羊皮的狗……

中国科学院派披着羚羊皮的深圳云深处X30四足机器人混入可可西里藏羚羊群,观察其行为。该机器人装备多类传感器和定位系统,能实时传输数据,还可远程控制,此前也有不少用机器人研究动物的案例。

AGI Hunt