「全云化架构」共找到 3465 篇相关文章
阿里+清华发现80/20法则:LLM只靠20%的token就能学会Reasoning
阿里与清华研究发现,训练大语言模型(LLM)推理时,真正关键的是20%的高熵token,其余80%低熵token几乎无用。仅用20%高熵token做强化学习,效果超全量训练,还提出RLVR训练策略提升效率。
旅行 AI 告别只会做规划的平庸时代,飞猪帮帮决定让 Agent 做履约
8月10日,飞猪推出新一代旅行AI“飞猪帮帮”,能力覆盖旅行全生命周期。它将用户需求分为“帮我想、帮我订、帮我办”,利用Qwen模型后训练,结合多种校验手段,让AI从提供信息到进入履约环节。
时隔九年,中国超级计算机重登世界榜首
当地时间6月23日,第67届TOP500超级计算机排行榜发布,国家超级计算深圳中心的‘灵晟’(LineShine)夺冠,运算速度达2.198 ExaFLOP/S。它仅用CPU,性能超美国El Capitan超20%,引发对未来计算架构思考。
代码Agent的苦涩教训!首次拆解上下文检索,直指自动化软件瓶颈
ContextBench首次从「过程」评测代码智能体,揭示当前模型多读少用、被关键词误导等深层问题。它基于真实问题修复任务,由专家标注「黄金上下文」,用多指标评估。研究显示,复杂架构未必效果好,模型重召回轻精确等。
字节跳动Seed推出「机器人大脑」Robix:让机器人学会思考、规划与灵活互动
近日,字节跳动Seed团队发布「机器人大脑」Robix,它将推理、任务规划与人机交互整合到单个端到端多模态模型。通过层次化架构分工,它能灵活互动,经三阶段训练,在多方面表现出色,为具身智能体发展奠基。
生成式推荐!推荐系统新范式还是新噱头?【文末抽现金红包】
文章探讨生成式推荐是新范式还是噱头。分析其与判别式推荐区别、效果收益来源,结合Meta GR、快手OneRec实例,指出其有提升但非万能,不同团队应按需选择,还提及可能带来架构革新。
千卡集群破壁之道:vivo视觉多模态大模型训练效率跃迁实战
多模态大模型在多领域需求增长,但千卡级 GPU 训练挑战大。vivo AI 架构师王兆雄在大会演讲,结合 LLaVA 和 DiT 模型实践,解析优化策略,分享提升训练效率与稳定性的经验,还展望了 AI Infra 未来。
18年前不让你苦修PS的美图,这次不让你苦修AI了
当前AI创作门槛渐高,美图在影像节推出8款AI产品,让用户少学技能拿结果。产品围绕交付成果,定位不同但本质相同。美图还在商业模式、组织架构上转变,市场成绩亮眼。
实测Claude Opus 4.7,好好的模型也开始不说人话了。
作者实测Claude Opus 4.7,它已全渠道上线,价格不变。该模型有多处更新,如隐形涨价、视觉能力提升、审美进步,但也出现不说人话的问题,还新增了effort档位、/ultrareview命令和Cyber Verification Program。
为何95%的AI项目注定失败?回到未来,策略型代理AI才是正确路径
《代理AI的进展:回到未来》指出,当前95%的AI项目失败因企业缺乏消费模型的架构。文章提出‘机器中的机器’理论,论证策略型代理AI是企业转型路径,还阐述构建算法化企业生态的方法。