Cantor集」共找到 560 篇相关文章

产品应用8

国产Deep Research杀出一匹「裸奔」黑马:免费开放,过程透明,网页报告一键即出

国产AI搜索秘塔AI搜索放大招,深度研究功能发布即免费公开,自带新玩法,思考过程透明。在评测上表现优,可应对复杂问题,生成规范报告,还能转互动网页,严谨度与易用性兼备。

量子位
开源动态8

性能提升84%-166%!L-Zero仅靠强化学习解锁大模型探索世界的能力 | 已开源

招商局狮子山人工智能实验室团队用RLVR让模型“自学”,构建L0系统,含NB - Agent框架和端到端强化学习训练流程,开源相关内容。测试显示L0显著提升模型性能,展现强大泛化能力。

量子位
算法论文8

九成以上模型止步白银段位,只有3个铂金!通用AI下半场评测标准来了

OpenAI研究员姚顺雨提出AI发展步入新阶段,下半场关键在评估模型真实智能。新加坡国立大学等团队提出“通才智能”评测框架,剖析多模态大模型短板,推出五级评估体系和测试,测试结果暴露模型弱点,引发社区积极反响。

机器之心
算法论文8

如何判断AI视频真假?综述动态、可溯源、可解释的检测体系 | ACL26

AI视频生成技术发展迅速,现有检测方法难满足需求。最新综述提出「事实保真度验证」目标,梳理出视觉与语言双视角的四层检测框架,还分析了检测方法演进、评测指标和数据,为AI视频检测提供落地地图。

新智元
产品应用7

Harness Engineering实践,做了一个平台让AI一晚上自动评测和优化你的系统

作者分享搭建小平台实现全自动化评测与系统优化的实践,包括创建评测任务、、报告等,通过钉钉文档、绘报等案例展示操作,还能自动优化系统,不过需系统UI规范、AI Coding含量高。

阿里云开发者
新闻资讯7

Generalist爆火背后:具身智能真正的竞争,已不在模型

Generalist AI发布的GEN - 1模型引爆具身智能领域,其多项指标出色,预示具身智能竞争从模型层转向基础设施层。行业关注焦点转移,数据正从‘静态数据’演进为‘动态教育系统’,评测与仿真基础设施成关键。

机器之心
产品应用7

数据合成篇|多轮ToolUse数据合成打造更可靠的AI导购助手

文章以租赁导购助理“小不懂”为例,介绍Tool Use训练数据合成方案。先分析训练数据的目标与难点,提出动态多智能体对话生成框架,阐述多轮数据、复杂问题合成及过滤方案,展示数据和模型效果,还提及未来工作方向。

阿里云开发者
开源动态8

港中文联手美团开源“视觉推理通才”!图像视频10类任务一网打尽

香港中文大学MMLab与美团研究团队开源OneThinker模型,它可覆盖图像与视频十类核心视觉任务,在31项测试中表现出色,还展现泛化能力。研究团队搭建数据,并引入EMA - GRPO算法提升训练稳定性。

量子位
算法论文8

准确率腰斩!大模型视觉能力一出日常生活就「失灵」

EgoCross项目团队聚焦跨域第一视角视频问答评测,揭示现有MLLM在多场景泛化瓶颈。团队提出跨域第一视角视频问答基准EgoCross,经测试揭示模型短板,验证改进方法潜力,研究入选AAAI 2026且数据等已开源。

量子位
算法论文8

LinearRAG:一种免关系提取的高效 GraphRAG 图构建方法

研究指出 GraphRAG 模型在实际应用中表现常不如朴素 RAG 方法,原因是自动构建的知识图谱质量不佳。为此提出 LinearRAG 框架,有三大核心创新,在四大基准数据上全面超越现有方法,代码和数据已开源。

深度学习自然语言处理