「迭代循环优化」共找到 1714 篇相关文章
社区供稿丨如何抑制大模型的“过度反思”:Yuan3.0 Flash 中的强化学习范式
大模型在企业落地时存在“过度反思”问题,浪费算力。YuanLab.ai团队在Yuan3.0 Flash模型中提出RIRM与RAPO,前者奖励“思考过程”,后者优化训练框架,实现推理效率提升,适用于企业场景。
Transformer已死?DeepMind正在押注另一条AGI路线
谷歌团队借鉴人类联想记忆,提出嵌套学习,解决AI「灾难性遗忘」问题。强调优化器与架构协同进化,构建联想记忆系统。HOPE架构在多任务表现出色,或开启AI从被动训练到主动进化大门。
AI+直播的新玩法! StreamDiffusionV2让创意零延迟
生成模型改变直播行业,但此前模型难保证时间一致性、有延迟等问题。加利福尼亚大学推出StreamDiffusionV2,通过智能调度和缓存机制优化,支持多GPU并行,可灵活调画质和延迟,实现实时直播。
HumanSense:探索多模态推理边界,打造「察言观色会共情」的全模态交互伙伴
蚂蚁集团与西安交通大学联合提出并开源 HumanSense,含评估基准与推理模型。通过细粒度评测、全模态消融等研究,提出优化策略,项目已在 GitHub 和 HuggingFace 开源,推动 AI 交互体验革新。
重塑AI记忆边界:MemOS开源!时序推理较OpenAI提升159%
近日,记忆张量等多家团队发布面向大模型的工业级记忆操作系统MemOS。它借鉴传统操作系统架构,实现AI记忆结构化管理,性能超OpenAI等方案,未来将成立社区、推进应用及持续迭代。
22.4K Star!这个开源 AI 工具给 Agent 装上「项目经理大脑」!
GitHub上项目Beads登上Trending榜单,它是为AI编程助手设计的分布式任务追踪系统,底层基于Dolt数据库,解决多AI协作痛点,有版本控制、AI优化等亮点,还提供多种安装方式。
RF-DETR-首个突破60 AP的实时检测器(附实战教程)
RF-DETR在COCO数据集上,实时检测精度首破60 mAP,兼顾实时性与高精度。它通过NAS找到Transformer实时运行的‘最优解’,迭代快,适用于多场景,还给出完整实战教程。
5行代码,逼疯整个硅谷!澳洲放羊大叔,捅开AI编程奇点
澳大利亚养羊大叔Geoffrey Huntley的5行代码Ralph-Wiggum循环震动硅谷。它让Claude Code和Cowork发展,开发者用其屡创佳绩。该技术强调失败价值,虽有局限,但预示软件开发行业深层转型。
SIGGRAPH Asia 2025:摩尔线程赢图形顶会3DGS挑战赛大奖,自研LiteGS全面开源
12月17日,在SIGGRAPH Asia 2025上,摩尔线程凭自研LiteGS获3DGS重建挑战赛银奖。3DGS是下一代图形渲染技术,有巨大潜力但训练耗时久。摩尔线程开源LiteGS,实现全链路协同优化。
如何让Agent更符合预期?基于上下文工程和多智能体构建云小二Aivis的十大实战经验
文章围绕云小二Aivis项目,分析Agent不按预期输出的原因,从预期和技术层面展开。还总结十大优化经验,如清晰预期、精准投喂上下文等,为构建和调优Agent提供参考。