「梯度更新」共找到 579 篇相关文章
吴恩达来信:建立为人类服务的智能体社群
吴恩达讨论编程智能体分享经验平台的可能性,介绍了解决编程智能体获取最新API文档问题的chub工具。他提出收集智能体反馈以更新文档,还受Moltbook和Stack Overflow启发,认为智能体贡献反馈很有价值。
AI能否独立开展科研?ASI-Bench为科学自主性建立评测标尺
ASI-Bench是衡量AI系统科学自主性的基准测试,由多机构联合开发。它能测试AI通用智能、创新性和执行力,通过信息梯度设计,让模型在不同指导量下完成科研任务,结果显示当前AI离自主科研有明显距离。
Manus 重新独立:这七个月一直没停下,但通用 Agent 的牌桌已经挤满了玩家
8月11日,Manus宣布将恢复独立运营,此前它被Meta收购仅七个月。过去七个月其产品更新频繁,年收入大幅增长。但通用Agent竞争激烈,OpenAI等大厂及创业公司纷纷入局,Manus需做深产品,且重新独立后面临增长考验。
BIGAI & 中科大团队提出 MILR: 测试时隐空间推理,让图像生成学会「边想边改」丨ICLR 2026
BIGAI与中科大等团队提出MILR,通过测试时隐空间推理,在不更新模型参数下优化图文表示,提升复杂图像生成能力。该方法在多基准测试达SOTA,还探讨了测试时扩展与奖励模型,未来有诸多拓展方向。
腾讯LLM团队:对下一个 Token 预测的深入剖析,多样性 or 精准度?
最新研究证实RL能增强LLM推理,但成效受限预训练token分布。腾讯LLM部把交叉熵重写成单步策略梯度,用超参压熵,为RL打造‘低熵高信号’起点,经实验验证低熵模型优势明显。
Codex 跟练全攻略
本文聚焦 Codex 学习,指出知名 AI 视频博主更新慢,而 B 站有全面的「Codex 跟练」专题,含快速安装、基础入门、进阶技巧、场景应用四个专区,不同阶段用户都能找到合适内容,视频跟练更高效。
字节押注AI Coding:百万月活的TRAE,如何改写开发者生态?|甲子光年
字节跳动在火山引擎Force 2025原动力大会主推自研AI编程产品TRAE,其月活超百万,内部80%工程师在用。AI Coding能提升大模型能力,助字节逼近AGI。TRAE更新功能,未来或成独立开发超级个体。
实测丨全新的「扣子编程」,全新的 Vibe Infra
作者见证扣子多次迭代,虽其曾沉寂,但近期更新打消疑虑。扣子推出「扣子编程」,拥抱 Vibe Coding,打造三大核心功能矩阵。作者实测其功能,从想法到成品速度快,还能一键部署,软件开发门槛降低。
Grok的“胡言乱语”:是代码出错,还是马斯克的“真心话”?
马斯克的人工智能Grok又出问题,发表反犹太言论、赞美希特勒后被紧急关停。xAI称是上游代码路径更新所致。此前Grok也多次‘发疯’,都以‘意外’解释。而特斯拉还将其塞进汽车,引发对其安全性的质疑。
无损减少80%激活值内存,提升5倍训练序列长度,仅需两行代码
港中文(深圳)和上海交通大学团队提出 StreamBP 算法,通过线性分解和分步计算,将大语言模型训练激活值内存降至梯度检查点的 20%,在相同内存下最大序列长度为其 2.8 - 5.5 倍,代码已开源。