「数据质量评估」共找到 3503 篇相关文章
人大高瓴孙浩团队发表Nature子刊封面文章:基于并行符号枚举的物理定律发现
中国人民大学高瓴人工智能学院孙浩教授团队在《自然 - 计算科学》发表封面论文。提出PSE框架解决符号回归瓶颈,通过公共子树复用和GPU并行提升评估效率,实验表现优于现有方法,也指出了局限性与未来方向。
造火箭的辞职去放牛,彼得·蒂尔花20亿美元押注一个AI牛项圈
彼得・蒂尔领投20亿美元融资给Halter公司的AI牛项圈。项圈能追踪牛的多项数据,有虚拟围栏功能。此外,何同学为粉丝做找牛系统,日本团队开发分析鸡情绪的AI系统。
这次,钉钉领先半目
钉钉发布会前,阿里成立Alibaba Token Hub事业群,设悟空事业部,钉钉归入其下。无招回归后思考AI时代钉钉形态,革故鼎新,推出真经系统等,在制造业案例展现优势,强调可编程企业概念,悟空有望带来新商业想象。
什么样的龙虾,才是「一人公司」的心头好?
AI时代,OPC概念火热,但过往大模型和Agent难落地。面壁智能官宣EdgeClaw Box,采用端云两栖架构,安全高效,适配多款硬件,可插电即用,还能降成本、保障数据安全,集成多种Skills,助力OPC提效。
ICLR-26腾讯混元:Agent是强大的,但用户是狂野的
现有LLM工具使用基准测试场景理想化,忽视真实用户行为复杂性。腾讯提出WildToolBench,基于真实用户行为构建测试集,对58个模型评估,发现模型准确率低,揭示LLM在真实场景下能力缺口,为模型优化指明方向。
字节开源版Seedance发布,超越Sora 2!
字节Alive团队发布开源版Seedance 2.0,在人类评估中超越Sora 2等。它通过统一架构、时空对齐技术和非对称训练策略,解决声画不同步和画质音质难两全问题,还建立数据流水线和测试基准。
核心AI场景首超英伟达,一场国产算力的“破局叙事”|甲子光年
1月26日,天数智芯公布四代架构路线图,其2025年的天数天枢架构,在DeepSeek V3场景实测性能领先英伟达Hopper约20%。该企业以技术创新、解决行业痛点等构建新范式,产品全场景布局且已规模化落地。
一个模型统一4D世界生成与重建,港科大One4D框架来了
港科大研究团队提出 One4D 框架,可统一 4D 生成与重建,构造同步输出多模态的视频扩散模型,支持多种任务形态。其有 DLC、UMC 等亮点,用合成与真实数据混合策略训练,实验表现佳。
笑死!xAI员工竟用Claude写代码?这回Anthropic反手拔了马斯克的网线
2026年1月8日消息,xAI联合创始人通知员工,Cursor中的Claude模型无法响应,是Anthropic针对对手的新政策。此前Anthropic已多次调整策略,封杀竞争对手,其目的包括保护数据资产等。xAI或加速自研,行业或开启军备竞赛。
让世界模型推理效率提升70倍:上海AI Lab用“恒算力”破解长时记忆与交互瓶颈
上海AI Lab联合多家机构开源Yume1.5,针对视频生成构建可交互“世界模型”的核心难题,提出时空信道联合建模(TSCM),实现近似恒定计算成本的全局记忆访问,展示了世界模型工程化落地的可行路径。