数据质量评估」共找到 3469 篇相关文章

产品应用7

Claude Code 强大的秘密究竟是什么?

Claude Code 强大源于其强大模型基础、丰富实用的内置工具、不压缩上下文信息及无 IDE 包袱等优势。相比之下,OpenAI 的 Codex 因模型能力、强化训练不足等落后,Anthropic 还靠亏本推广积累数据

宝玉AI
产品应用8

Google | 发布革命性编码智能体:AlphaEvolve,突破数学极限!

DeepMind 发布由 LLMs 驱动的进化编码智能体 AlphaEvolve,能演化代码库用于算法发现和优化。它结合 LLM 创造力与自动化评估,减少幻觉,在谷歌计算生态、数学算法等多领域有巨大应用潜力。

AINLPer
开源动态7

ICML25 | 让耳朵「看见」方向!仅依靠360°全景视频,就能生成3D空间音频

空间音频技术成提升沉浸式体验关键,但现有技术未充分利用360°全景视频空间信息。OmniAudio研究可直接从360°视频生成空间音频,相关代码和数据集已开源,虽有局限但前景好。

量子位
新闻资讯8

刚刚,马斯克Grok 4.1低调发布!通用能力碾压其他一切模型

xAI 低调发布 Grok 4.1 并向所有用户开放,可多平台使用。该模型在真实世界可用性上显著提升,尤其在创造力等方面出色。它在多项评估中表现优异,通用能力领先,情感智能、创意写作佳,还降低了事实幻觉。

机器之心
产品应用7

Win狂喜!国产Cowork和Codex App,昆仑万维Skywork桌面版发布

2026开年AI圈热闹,办公自动化方面Claude Code、Codex App等新动态频出,但Cowork和Codex App仅支持Mac OS。不到24小时,昆仑万维天工Skywork桌面版发布,原生支持Windows,集成强模型,数据安全有保障,价格亲民。

AIGC开放社区
开源动态8

开源模型两个月内杀死比赛

过去60天,Vercel AI Gateway调用数据显示,开源模型Token调用份额从28%涨至62%,反超闭源模型。英伟达60亿美元入局扶持,闭源虽推新降价仍失领先,开源走向大规模应用。

AI前线
新闻资讯7

机器人的“ChatGPT时刻”为何迟迟未来?

俄勒冈州立大学教授乔纳森和前 Google X 高管汉斯探讨机器人有无“ChatGPT 时刻”。指出机器人领域难现单一突破,需工程实践、工具配合和数据积累,还从多方面分析了面临的问题。

DeepTech深科技
产品应用8

字节发布通用游戏智能体!5000亿token训练,用鼠标键盘吊打GPT-5!

字节seed团队打造通用游戏智能体Game-TARS,基于键盘—鼠标动作空间训练,用超5000亿标注量级数据,结合新技术提升扩展性和泛化性,在多类游戏任务中表现超越GPT - 5等模型。

量子位
算法论文7

直播预约 | 强化学习训练能否不依赖外部知识优化模型的弱点?

论文提出 SwS 框架,针对强化学习场景,利用模型自我感知弱点驱动自动化问题生成,合成针对性训练数据。还对其进行多项扩展,在多个基准测试集和模型上验证有效,性能提升显著。

深度学习自然语言处理
算法论文8

JCP | 南科大赵肃楠、王建春等:LESnets:基于物理信息神经算子的湍流大涡模拟

本研究提出基于物理信息神经算子的LESnets方法,用于快速模拟粗网格上三维湍流时空演化。不使用标签数据,训练两种神经算子,验证了其有效性和泛化能力,效率显著优于传统方法。

力学与人工智能