「可预测并行架构」共找到 2405 篇相关文章
Claude神之bug:给自己下指令,还诬赖用户??Hacker News炸了
强如Claude也现诸多bug,如分不清发言角色,把恶意注入指令当用户请求。技术根源是Transformer架构注意力机制盲区。网友给出避坑方案,还吐槽Claude算力调整、计费乌龙等问题。
智源新出OmniGen2开源神器,一键解锁AI绘图「哆啦 A 梦」任意门
2024年9月智源研究院发布统一图像生成模型OmniGen,获社区好评。近期OmniGen升级为OmniGen2,增强多方面能力且全面开源。它采用新架构与策略,有反思机制,玩法丰富,还推出新基准优化部署。
AI破译生命!微软蛋白质研究「超级加速器」登上Science
微软研究AI for Science团队推出BioEmu,能模拟蛋白质在平衡状态下的各种可能结构集合。它输入蛋白质序列就能生成大量结构样本,预测性质,速度比传统方法快10万倍,已开源助力药物研发。
当10亿个AI一起模拟未来:李飞飞和Karpathy共同押注的新赛道|5Y Research
本文聚焦Multi - Agents模拟预测这一AI前沿方向,介绍其发展、原理、应用场景及代表公司。它能为人类社会建可反复运行的“世界模型”,虽潜力大,但面临验证难、技术瓶颈等问题。
Claude团队大揭秘!如何调动多智能体搞深度搜索
Claude团队分享用多智能体构建深度搜索的心得,展示有效多智能体研究系统架构,涵盖系统架构、提示工程、评估方法等内容,还提及系统面临的问题、挑战及额外建议。
去掉像素中介!上海交大让AI边看边想边画,用同一个“大脑”跨模态推理
上海交大等团队提出LatentUM架构,摒弃像素解码中介,在共享语义潜空间跨模态思考。它用MBAQ技术转化视觉特征,设计MoME架构,还能自我反思、规划路线、模拟世界演变,表现出色。
自动化评测的九九归一——评测agent
本文提出统一评测Agent架构,实现评测全链路自动化。它能学习标注标准,完成自动标注等工作。还介绍架构、解耦方法、模型优化及训练方案,解决多模态幻觉等问题,提升机审率,节省标注成本。
昇腾MindSpeed:分布式训练加速库的创新实践与突破
在2025年QCon全球软件开发大会上,华为工程师郑加利分享昇腾MindSpeed分布式训练加速库。它在计算、通信、显存等多维度优化,提升训练效率,还介绍业界加速库及MindSpeed架构,阐述多种优化策略。
老黄喝豆汁「破防」背后,国产GPU正在填上CUDA护城河
老黄喝豆汁刷屏,但更值得关注的是国产GPU生态。摩尔线程发布会展示MUSA生态,实现全方面覆盖,从兼容到自进化,在云端、端侧应用出色,还打通全链路,且未用最强架构。
顶级视频模型半衰期只有 30 天,但生成式媒体 infra 公司的收入却在一年增长了 60 倍
文章聚焦生成式媒体 infra 公司 fal.ai,其借统一 API 和云端平台让开发者高效调用多模态模型。深入分析其成功因素,如早期押注生成式视频、优化算力和成本、构建生态等,还探讨用户使用模式与行业发展趋势。