「数据污染治理」共找到 2594 篇相关文章
微软 CEO Satya:“传统的软件应用层正在瓦解,将逐渐被AI智能体(Agent)所取代”
微软CEO Satya Nadella称传统软件应用层正瓦解,将被AI智能体取代。微软布局‘AI智能体层’,让Microsoft 365成集成开发环境。他还号召SaaS企业成为数据源,专注数据API建设。
蚂蚁 | 提出代码检索/重排基准:CoREB,揭开高分榜背后的三大幻觉,现已接入MTEB
蚂蚁研究人员提出代码检索与重排评测基准CoREB,解决现有基准相关性软、数据污染、任务方向单一问题。它已集成进MTEB,收录19个模型×6个任务评测结果,为代码检索模型评估提供新基线。
Harness Monitor:当多个 Agent 同时写代码时,如何看住质量
作者在有了 OpenAI 赞助的 Codex Pro 后,让多个 Agent 同时在一个代码库工作。他开发的 Harness Monitor 从 Git 视角出发,解决多 Agent 写代码时的质量问题,涉及观察、治理等多方面能力。
告别「手搓Prompt」,前美团高管创业,要让物理世界直接成为AI提示词
在2025年AI硬件赛道火热背景下,Looki创始人孙洋团队打造Looki L1可穿戴设备,将自动驾驶逻辑用于生活场景,转化视听信号为模型上下文,构建用户专属数据飞轮,让AI实现主动共鸣。
写在 Claude Design 发布之后:如果明天巨头做掉了你的核心功能,你该怎么办?
Anthropic 发布 Claude Design,可从提示词生成设计稿等,让 Figma 市值蒸发。这引发对 AI 应用层产品的思考,当基础模型厂商收回能力,靠能力缺口的产品将失重,应用层需从工作流、数据等找机会。
黄仁勋对话 10 位开源 AI 掌门人:未来算力将向后训练倾斜,OpenClaw 开启了现代计算机的新想象|GTC 2026
在 GTC 2026 上,黄仁勋与 10 位开源 AI 掌门人探讨开放模型。大家认为 AI 正从模型走向系统,未来算力或向后训练倾斜。OpenClaw 让大众感知到 agent,企业落地难点在治理,开放模型价值体现在可控、定制和信任。
港中文联手美团开源“视觉推理通才”!图像视频10类任务一网打尽
香港中文大学MMLab与美团研究团队开源OneThinker模型,它可覆盖图像与视频十类核心视觉任务,在31项测试中表现出色,还展现泛化能力。研究团队搭建数据集,并引入EMA - GRPO算法提升训练稳定性。
在失败中进化?UIUC联合斯坦福、AMD实现智能体「从错误中成长」
伊利诺伊大学厄巴纳 - 香槟分校等团队发布论文,剖析LLM智能体失败机制,提出可自我修复的创新框架AgentDebug。研究指出智能体常见失败类型,构建错误分析体系、数据集,实验显示该框架效果显著,为AI可靠性提供方案。
视觉Token注入CLIP语义,走向多模态理解与生成新范式
腾讯ARC Lab等机构提出全新视觉分词器TokLIP,将低级视觉Token与高级CLIP语义结合,支持端到端自回归训练,可接入LLM框架,降低计算与数据门槛,在多模态任务中表现优异,代码已开源。
国产AI击败Meta:ReasonRank荣登BRIGHT榜单第一
基于LLM的段落排序方法中,listwise排序虽有优势,但当前重排器难处理复杂推理查询。ReasonRank通过生成推理密集型训练数据及两阶段后训练,赋予listwise重排序器强推理能力,在BRIGHT榜单击败Meta。