「数据处理」共找到 3286 篇相关文章
用Diffusion构建「AI虚拟细胞」,14项指标霸榜!Mila唐建团队破解单细胞「破坏性」测序难题
Mila唐建团队发表PerturbDiff,跳出前人认知盲区,将“细胞群体的概率分布”视为随机变量。它引入数学工具建模,让MMD内生于体系,在多项基准测试霸榜,还提供应对数据稀缺的思路。
Anthropic 最新博客:构建 AI Agent 评估体系完整指南
Anthropic 工程团队发布博客《Demystifying evals for AI agents》,揭秘内部对 AI Agent 的评估方法,涵盖评估结构、构建原因、常见 Agent 类型评估技术、评估非确定性处理、构建路线图及与其他方法配合策略等。
你聊得很开心的AI女友,背后却是被当做耗材的肯尼亚小伙们。
肯尼亚小伙迈克尔应聘工作后,成了伪装AI的陪聊员。工作严苛,还得忍受不适内容。公司借此收集数据训练算法,他越努力就越快被替代,成了AI时代的‘耗材’。
ICCV 2025 | 港科、牛津大学发布AlignGuard,文图生成模型可规模化安全对齐框架
随着文图生成模型广泛应用,其安全防护机制有限。ICCV 2025上,港科、牛津大学推出AlignGuard,是文图生成模型可规模化安全对齐框架,通过生成CoProV2数据集等实现安全对齐,实验效果佳。
ACMMM 2025 | 北大团队提出 InteractMove:3D场景中人与可移动物体交互动作生成新框架
北大团队在ACMMM 2025发布InteractMove,首次提出含可移动物体3D场景中基于文本的人 - 物交互生成任务,构建数据集与创新框架,在多指标领先,代码与模型已开源。
数学界地震!GPT-5连破10道「百年悬案」,陶哲轩:AI革命才刚开始
两位研究人员用GPT - 5仅一个周末就解决10个埃尔德什难题,GPT - 5还在另外11个问题有显著进展。数学家陶哲轩称AI最有成效应用是处理琐碎耗时环节,重塑数学研究。
DeepSeek V3.1 突发离谱「极」字Bug的原因找到了~
DeepSeek V3.1被曝恶意漏洞,生成文本时会突然插入“极”字。该漏洞在第三方API平台和官方Playground均有出现,可能因数据集“污染”或模型“偷懒”,严重影响高精度场景。
上海交大/上海AI Lab翟广涛:当评测不再重要,AGI就实现了
上海交通大学教授翟广涛认为完美的AI评测体系等同于通用人工智能。当下评测体系存在数据污染、原子化能力评测局限等问题,他主张回归‘以人为本’,团队提出相关框架和技术路径,目标是训评一体。
Claude Code发布4个月,用户已经11.5万了,开发者:200 美元/月不算贵
Anthropic的Claude Code发布4个月吸引11.5万开发者,一周处理1.95亿行代码。它集成Claude Opus 4模型,功能实用,口碑好,让开发者觉得物有所值,反映开发者对AI编程工具接受度提升。
复旦提出自适应Reasoning方法ARM,“能屈能伸”
复旦提出自适应Reasoning方法ARM,解决LLM‘过思考’问题。ARM内置四种解题策略和三种决策模式,还搭配Ada - GRPO算法,在23个数据集测试中表现出色,省token、提速度且准确率高。