工程设计」共找到 1904 篇相关文章

产品应用8

登顶SuperCLUE DeepSearch,openPangu-R-72B深度搜索能力跃升

近日 SuperCLUE 发布 11 月 DeepSearch 评测报告,国产大模型 openPangu - R - 72B 名列第一。它采用 MoE 架构平衡效率与性能,经预训练技术优化和 DeepSearch 专项突破,彰显国产算力与大模型研发融合成效。

机器之心
产品应用7

关键技术详解|腾讯一念 LLM 分布式推理优化实践

InfoQ 邀请袁镱分享《一念 LLM 分布式推理优化实践》。介绍了“一念 LLM”设计思路、推理优化挑战与突破等,还对比不同框架,指出优化方向,如先实现 PP,再推进 EP 与 PD 分离。

InfoQ
新闻资讯7

CTO 焦虑自白:为什么我们有了 AI 博士生,但员工却越干越累?| 直播预告

本次直播由值得买、飞猪与彩讯多位专家,从 CTO 视角实战复盘 AI 落地与工程化挑战,探讨 AI 提效 ROI 临界点、能力错配等问题,还会深度复盘模型落地困局,拆解‘人效陷阱’等。

InfoQ
新闻资讯8

周志华,院士!

2025年中国科学院、工程院院士增选结果出炉,共144人当选,新增外籍院士51人。人工智能领域,南京大学周志华教授当选中科院院士。他成就颇丰,论文被引超11w次,《机器学习》成入门宝典。

量子位
产品应用7

2025 社交新方式:当 AI 成为「第二个我」,去实现「真实连接」

作者作为业余AI产品经理,体验Second Me这款AI应用。它能借助AI复刻「AI自我」,基于记忆匹配社交,作者借此完成与他人的深度交流。同时探讨了AI社交风险,认为AI应是社交起点,帮人筛选和破冰。

特工宇宙
算法论文8

告别「一条路走到黑」:通过自我纠错,打造更聪明的Search Agent

为解决知识实时性和推理复杂性挑战,搜索智能体(Search Agent)应运而生,但缺乏自我纠错能力。腾讯联合清华提出 ReSeek 框架,引入动态自我修正机制,还构建 FictionalHot 数据集评估,实验效果良好。

机器之心
算法论文8

AEPO:智能体熵平衡策略优化,让探索更稳,推理更深!

中国人民大学与快手团队联合提出 AEPO 算法,解决熵驱动式智能体强化学习训练不稳等问题。它设计两项核心机制,在 14 个基准上优于主流算法,在 X 等平台获高关注。

机器之心
新闻资讯7

AI 项目总踩坑?小团队、渐进研讨带你找到正确打开方式

Cloud Native Summit 2025奥克兰大会探讨企业借Open Practice Library将协作模式转化成果。Andrea Magnorsky分享Byte - Sized Architecture方法,Ahilan Ponnusamy与Andreas Grabner介绍企业采用AI的迭代式框架,强调小规模持续研讨。

InfoQ
8

OpenAI 内部是怎么使用 Codex 的.pdf

文章基于对 OpenAI 工程师的采访和内部使用数据,汇总了 Codex 在 OpenAI 内部的使用案例和最佳实践。展示其在代码理解、重构迁移等七大场景的应用,还给出使用的最佳实践,认为未来潜力大。

AGI Hunt
技术文章7

让NCCL性能起飞的NCCL symmetric memory是啥黑科技?— part1

本文是NCCL 2.27新特性系列首篇,介绍symmetric memory。它类似NVSHMEM,现仅支持单节点通信,未来将支持跨节点。其低延迟内核能提升小数据通信性能,还介绍使用示例、CUDA内存管理及Symmetric Memory实现等内容。

GiantPandaLLM