观测的暴露度」共找到 10611 篇相关文章

开源动态7

Headroom:Netflix 工程师开源上下文压缩工具,省 token 还是烧 token?

Netflix工程师Tejas Chopra开源Headroom,定位为AI Agent上下文压缩层,压缩工具输出等内容,有可逆压缩等特性。官方数据显示节省token效果好,但微软工程师实测结果中性偏负面。

AI工程化
新闻资讯7

龙虾爆火之后,AI初创全球化机会来了吗?|明天见

龙虾爆火,AI初创全球化机会几何?3月26日14:00举办出海沙龙,小影科技、谷歌等实践者分享经验,Leewow等初创团队分享产品实践,还将探讨出海窗口期、门槛等话题。

量子位
算法论文8

YC总裁转发、登顶Hacker News:SkillsBench揭开Agent技能扩展残酷真相

近日论文《SkillsBench: Benchmarking How Well Agent Skills Work Across Diverse Tasks》引发海外AI社区关注。研究聚合47150个Skills,经严格筛选评估,揭示人工构建Skills效果好、AI自生成无效等核心发现,为AI研发指明路径。

机器之心
新闻资讯7

AI鉴别攻略全废!别数破折号了,97%人根本分不清

当AI学会故意写错别字、流露人味,以往靠破折号、排比句等鉴AI攻略失效。人类直觉也不可靠,文章建议从上下文、风格连贯性鉴别,还指出AI话术平庸反映人类表达荒芜。

新智元
产品应用8

全球首个负载100斤真实持续干活机器人,来自银河通用

银河通用发布具身智能重载机器人Galbot S1,双臂最大负载50公斤,突破行业上限。它搭载具身搬运模型,可全自主作业,已在宁德时代等企业产线应用,标志具身智能融入产业升级主航道。

量子位
开源动态8

单卡跑出集群效率!Hugging Face TRL 与 RapidFire AI 超并行革命

Hugging Face宣布其核心微调库TRL集成RapidFire AI,重构大模型后训练阶段工作流。RapidFire引入超并行实验引擎,提升实验验证速度,解决算力受限团队调参难题,带来效能质变。

AIGC开放社区
开源动态8

狂涨14.4K star!大三学生开发Github可视化利器,真吊!

开源君介绍`gitdiagram`,这是结合AI与Web开发栈开源工具,能将GitHub仓库变成交互式架构图。由大三学生开发,获14.4k星标,微软等企业团队采用,性能佳、使用便捷。

开源先锋
算法论文8

GPT-5都救不了AI幻觉,原来问题不在模型,在“考卷”

OpenAI研究指出AI产生幻觉根本原因是评估和激励机制有问题。现有训练和评估流程奖励‘猜测’,导致模型易产生幻觉。研究还给出解决方案,要更新‘考试规则’,让模型适当表达不确定。

AIGC开放社区
算法论文8

大型语言模型稳定强化学习新路径:几何平均策略优化GMPO

本文介绍了大型语言模型稳定强化学习新路径——几何平均策略优化GMPO。它是GRPO稳定化版本,通过优化几何平均替代算术平均,解决GRPO训练不稳定问题,在多任务实验中显著优于GRPO。

机器之心
推荐文章7

Agent当道、模型封装一切:AI 时代产研人如何不被“优化”?

随着 Agent 普及,技术复杂性被模型封装,产研人面临挑战。InfoQ 直播栏目邀请嘉宾探讨应对之策,还分享 AI 项目经验,分析 AI 编程痛点、落地案例,以及产品上线障碍和商业化方向。

InfoQ