「深度主动优化」共找到 2054 篇相关文章
实测字节扣子空间:AI 播客比真人丝滑,Agent 能打 80% 的工
本文对字节跳动旗下 Agent「扣子空间」进行实测。它上线新玩法一键生成播客,相比通用 Agent 能力更丰富。此外,它还具备搜图、深度分析、写代码、开发网站等功能,兼具通用能力与低代码开发特点。
AI仅凭“自信”学会推理,浙大校友复刻DeepSeek长思维链涌现,强化学习无需外部奖励信号
UC Berkeley团队提出新训练方法Intuitor,大模型无需接触真实答案,仅优化自身信心就能学会复杂推理。该方法无需外部奖励信号或标注数据,用模型自身置信程度作内在奖励信号,在多任务表现良好。
多邻国的「AI-first」到底是什么?|AGIX投什么
本文深度访谈多邻国联合创始人及CTO Severin Hacker,探讨其“AI-first”策略。多邻国自成立就确立该理念,AI提升内容创作效率、实现新功能,在运营多方面应用,还分享早期教训、产品策略和团队文化等。
从像素空间走向数据流形:生成模型的对抗净化新范式 | TPAMI'26
深度神经网络虽应用广泛,但对对抗样本脆弱,制约可靠部署。本文介绍发表于TPAMI 2026的工作,提出基于一致性模型的对抗净化方法(CMAP),实验表明其在不同场景下鲁棒性强,为对抗防御提供新视角。
揭秘 | 桥梁缺陷检测新突破:模型压缩42%,精度几乎不掉
全国公路桥梁超百万座,传统人工巡检效率低且有安全风险,现有深度学习检测模型体积大、计算量高。研究团队提出LBSD - YOLO网络,通过创新实现轻量化,实验显示模型瘦身但性能不减,有重要应用价值。
GCEA-YOLO:给油田装上"防火眼",把抽烟行为检测精度拉高 20.8%
油田抽烟事故损失大,传统检测方法有局限,深度学习模型也面临难题。作者基于YOLOv11n构建GCEA - YOLO网络,含ADown、CSP - EDLAN、GFPN、EfficientHead四个模块,检测精度显著提升,还验证了泛化与稳定性,并给出复现代码。
评论送书 | 想系统了解AI?先搞清楚这四件事
文章围绕系统了解AI需搞清楚的四件事展开,介绍了AI理论基础层的机器学习和深度学习,感知交互层的计算机视觉等,应用实践层的机器人学等,还提及伦理社会层的AI伦理和社会影响研究。
50FPS、成本打掉70%,魔芯MoWorld把世界模型带进产业时代
近期,魔芯科技联合浙江大学潘云鹤院士、华为等发布实时交互世界模型MoWorld,推理速度超50FPS,部署成本仅为同规模GPU方案的30%。它全链路优化,将用于多行业,魔芯也完成亿元美金融资。
刚刚DeepSeek宣布大规模扩张,整体至少扩员一倍,全体岗位集体喊人加入
DeepSeek宣布大规模扩张,各部门规模至少扩一倍。其发力点包括底层算力与系统优化、高质量数据、Agent与应用落地及探索Next Level科研。用人反内卷、反官僚,岗位接受实习,还新增AGI核心业务管培生。
将DSA注意力引入多模态,快手Keye2.0开启强化推理新范式
快手发布新版多模态大模型Keye-VL-2.0-30B-A3B,率先将DSA机制引入多模态理解场景,解锁256K超长上下文深度感知,还首次解锁Agent协作机制。该模型在多方面表现出色,且将融入业务带来收益。