数据质量评估」共找到 3466 篇相关文章

新闻资讯7

250份文档“毒晕”大模型!无论规模大小统统中招

Claude母公司Anthropic联合两大机构研究发现,仅250份恶意文档就能在不同规模大模型植入“后门”漏洞,打破以往对大模型数据中毒的认知,给厂商防御敲响警钟。

量子位
新闻资讯8

Gemini灵魂人物加盟xAI,马斯克亲自夹道欢迎!

前谷歌DeepMind资深研究员Dustin Tran加盟xAI,他是Gemini共同创造者,助谷歌追回AI风口。Tran介绍跳槽原因,涉及算力、数据和认同马斯克理念,还补刀OpenAI点子库存见底。

量子位
开源动态7

Agent能自己“复盘”和“进化”,这个开源框架牛了!

文章介绍了自进化AI,其核心是执行、评估、进化的反馈循环,能自动修改Prompt和工作流。还讲解了SEW、TextGrad等优化器原理,并以SEW为例展示逻辑,最后推荐开源框架EvoAgentX。

探索AGI
新闻资讯7

这事你还没注意呢,巨无霸已经完成“反超时刻”

过去 GPT 在 AI 领域一枝独秀,大家认为二三名与它有代际差距。但 Google 的 Gemini 2.5 Flash Image 发布后,其生图速度和质量提升,解决“连续性”问题,带来自然交互体验,标志 AI 进入新阶段。

MacTalk
新闻资讯7

OpenAI与Anthropic罕见合作:竞争对手联手测试AI安全

OpenAI和Anthropic完成联合评估,用内部工具测对方模型并公开结果。测试覆盖指令层级、越狱等四大领域,还发现不少细节和道德困境情况。此次合作意义重大,为行业树立安全合作先例。

AGI Hunt
算法论文8

砍掉70%内存!陈丹琦团队破解LLM长文本瓶颈

大型语言模型处理长文本时,KV缓存占用内存巨大。陈丹琦团队提出KV足迹作评估标尺,推出分块驱逐与PruLong训练技术,在128K长文本任务中最高降低70%内存,性能损失仅10%。

深度学习自然语言处理
算法论文8

说句话就能飞!北航发布语言交互的无人机控制模型

北航刘偲教授团队提出语言引导的细粒度无人机轨迹控制研究框架,定义Flow范式。采用模仿学习法让无人机响应指令,构建数据集和仿真评测基准,还提出协作策略和算法,实现真机部署。

量子位
算法论文8

ACL 2026|清华新作ControlAudio:声音何时响、说啥话?都能按剧本可控生成!

现有文生音频技术在精细化控制方面有挑战,清华团队提出ControlAudio方法。它通过数据构造、渐进式训练和引导采样,在统一框架下实现时间与语音内容联合建模,在多项任务上表现优于现有方法。

机器之心
算法论文8

人形机器人控制新突破!敏捷稳定两不误,一个策略让人形机器人完成叶问蹲和跳舞|港大&英伟达&清华

港大、NVIDIA和清华联合团队提出AMS统一人形机器人全身控制框架,首次在单一策略实现动态运动跟踪和极限平衡控制。通过异构数据源、混合奖励机制和自适应学习策略,解决数据限制和优化目标冲突问题。

量子位
新闻资讯7

ICLR 2026出分,审稿员怒喷「精神病」!DeepMind研究员教你绝地求生

ICLR 2026评审结果公布,投稿量近2万篇创新高,但分数滑坡,平均分从5.12跌至4.2。审稿人吐槽质量低,甚至有怒喷‘精神病’的情况。DeepMind研究员提供论文反驳指南,称同行评审像‘随机数生成器’。

新智元