「优化过程」共找到 1494 篇相关文章
刚刚,DeepSeek 突发梁文锋署名新论文:V4 新架构提前曝光?
今天凌晨,DeepSeek在GitHub开源新论文与模块Engram,论文提出“查—算分离”机制,通过可扩展查找记忆结构提升模型表现。Engram将记忆与计算职责分离,或成V4核心技术,获网友肯定。
MiniMax海螺视频团队首次开源:Tokenizer也具备明确的Scaling Law
MiniMax海螺视频团队首次开源,揭晓视觉分词器难题答案。其推出的VTP框架可提升模型性能,解决传统Tokenizer缺陷,还展示了Tokenizer的Scaling Law,为行业提供新路径。
从"单芯作战"迈向"系统集成":产业变革背景与两大关键技术
随着摩尔定律逼近极限与AI算力需求爆发,集成电路产业正从‘单芯作战’迈向‘系统集成’。文章介绍Chiplet和SoW技术内涵、优势,对比二者差异,还提及中国‘软件定义晶上系统’技术路线及产业发展现状。
AAAI 2026结果公布,刷出88887高分!2.3万投稿录用率仅17.6%
AAAI 2026录用结果公布,投稿量达23,680篇创历史新高,录用率仅17.6%。多位研究员论文被录用,如北大顾怿洋、南洋理工加小俊等。同时,Reddit上对此次录用讨论热烈,有人质疑存在‘关系户’现象。
0人工参与实现梯度更新!MIT新框架让AI自动生成微调数据,权重自主升级
MIT提出新强化学习框架SEAL,可让模型生成微调数据和自我更新指令,实现权重更新。无需人工,模型能自动梯度更新。经知识注入和小样本学习实验验证效果,还介绍了其双循环工作机制。
谷歌揭秘:Multi-Agent 推理时扩展才是未来。
谷歌DeepMind和MIT联合发表论文TUMIX,指出Multi - Agent是推理时扩展的最佳方式,以低成本大幅提升准确率。实验表明Agent多样性优于重复采样,还展示TUMIX机制、实战表现,且LLM能设计更强Agent。
北大校友、华人学者金驰新身份——普林斯顿大学终身副教授
华人学者金驰宣布在普林斯顿晋升为终身副教授,任命2026年1月16日生效。他在机器学习理论领域贡献大,为LLM崛起提供数学基石,解决非凸优化和强化学习样本效率等问题。
YC 编写的 《Vibe Coding 指南》
本文是 YC 编写的《Vibe Coding 指南》,采访多位创始人总结出 AI 协作编程指南,涵盖规划流程、版本控制、测试框架等多方面,还提及 AI 在编码外的应用及持续改进方法。
聚焦AI视听创作源培育 首创郎园发布“银河人才计划”
8月19日,北京AIGC视听产业创新中心亮相,首创郎园发布“银河人才计划”。该计划以“挖掘—孵化—赋能—闪耀”为路径培育AI视听人才,还携手高校打造产教融合实验室,构筑AI视听人才新高地。
双“雷”暴击!Trae 被曝资源黑洞、Claude背刺超级付费党,开发者们被“刀”惨了
主打“自动化执行、多模型调用、上下文记忆”的AI编程应用大热,但也出现运行卡顿等问题。Trae被曝过度消耗资源,Claude Code对付费用户增加调用限制,凸显AI产品资源问题及厂商成本管控困境。