「数据分析」共找到 3322 篇相关文章
AI胡说八道这事,终于有人管了?
AI大模型幻觉问题棘手,GPT - 5幻觉率降低。苏黎世联邦理工学院和MATS研究提出低成本、可扩展检测法,精准识别实体级幻觉,分类器超现有基准,还能识别逻辑错误,团队已公开数据集。
北大-灵初重磅发布具身VLA全面综述!一文看清VLA技术路线与未来趋势
GPT-4o等多模态基础模型发展,让研究者探索将智能延伸到物理空间,VLA模型受关注。北大 - 灵初联合实验室从动作词元化视角提出新框架,分析主流action token,还介绍了VLA发展趋势及面临挑战。
Gemini 2.5 Pro 是怎么炼成的?-- gemini 2.5 技术报告阅读笔记与思考
文章是 Gemini 2.5 技术报告阅读笔记。介绍其成功点有多模态、LongContext、思考能力;还阐述模型结构、训练和数据情况,以及代码、事实性、长上下文等特定能力的提升,最后提到基于其构建的智能体。
只训练数学,却在物理化学生物战胜o1!新强化学习算法带来显著性能提升,还缓解训练崩溃问题
上海创智学院、上海AI Lab的MM - Eureka系列工作提出新强化学习算法CPGD,缓解训练崩溃问题,提升性能。还构建多模态强化学习框架,推出MMK12数据集和MM - PRM模型,开源相关成果。
纳米AI,拯救被电商套路榨干的2小时
作者买吸尘器时在电商平台耗费大量时间,凸显购物决策难题。纳米AI超级搜索智能体登场,能精准分析需求、筛选信息、比价等,还能制作AI视频和儿童教育内容,交互体验也有创新。
Sglang 源码学习笔记(三)- 分布式和并行(以deepseek 为例)(WIP)
文章是 sglang 源码学习笔记,聚焦分布式和并行,以 deepseek 为例。介绍通信域类型,分析 ZMQ 和 torch.dist 通信,阐述 TP、DP、EP 实现,包括初始化、使用等,还涉及不同 Linear 层 TP 及 MoE 不同实现情况。
Qwen3家族训练秘籍公开:思考/非思考融进一个模型,大模型蒸馏带动小模型
Qwen3技术报告揭晓8款模型关键技术,采用双模式架构,训练和微调分段进行,还“大带小”蒸馏数据。其融合思考与非思考模式,训练分多阶段,Qwen Chat还全量上线深度研究功能。
最强编码模型 Fable 5.1 发布:性能翻倍、Agent 成本降 45%,Anthropic 把顶级模型送进真实世界
当地时间9月1日,Anthropic发布Claude Fable 5.1和Claude Mythos 5.1,新模型在多方面能力提升,Agent工作负载成本最高降45%,此次发布还涉及价格、数据留存等多方面内容,争夺高价值任务市场。
openclaw,从流量对比和搜索意图可以学到什么?
作者白杨SEO从搜索精准流量从业者角度,分析OpenClaw在各平台流量对比、用户搜索意图,探讨搞搜索流量可学之处及对OpenClaw的看法,指出其开源免费但用大模型需付费。
从「偶然发现」走向「必然创造」:AI如何重塑生物制造全链路?
2026年1月9日“第四届合成生物学及生物制造大会”上,深圳瑞德林李加忠指出AI4S驱动合成生物学变革,从“经验驱动”变为“数据与逻辑驱动”,并分享瑞德林通过AI4S重塑生物制造全链路的实践。