迭代循环优化」共找到 1720 篇相关文章

新闻资讯8

20万人抢的全球大模型第一股,我中签了

智谱在港交所上市成全球大模型第一股,作者申购中签。智谱专注AI Coding,代快,GLM - 4.7成绩亮眼,商业化数据佳,还有诸多有意思细节,虽行业竞争大,但它表现不错。

花叔
产品应用8

Hybrid Model Support:阿里云 Tair 联合 SGLang对 Mamba-Transformer 等混合架构模型的支持方案

文章介绍阿里云 Tair KVCache 团队与SGLang社区在推理框架上支持混合架构模型的工程化实践。分析混合架构崛起原因、面临挑战,阐述内存管理、关键技术优化方案,验证性能,并指出未来演进方向。

阿里云开发者
算法论文8

刷榜自动驾驶语义场景补全!北大新作:高维度、高密度 | AAAI'26

北京大学彭宇新教授团队提出视觉语义场景补全方法HD² - SSC,通过高维度语义解耦和高密度占用优化,解决现有技术维度与密度差异问题,在两自动驾驶数据集上取得最优性能。

新智元
算法论文8

所有大模型,都学物理学:北大物理系一篇研究,震撼了AI圈

北大等机构团队跨界用物理学最小作用量原理,提出新颖方法估计 LLM 生成方向性,揭示其背后‘物理定律’。发现 LLM 生成有细致平衡现象,还能用物理指标给大模型画像,让 AI 研究提升到‘物理科学’高度。

机器之心
算法论文8

NeurIPS 2025|指哪打哪,可控对抗样本生成器来了!

近日,清华大学和蚂蚁数科在NeurIPS上联合提出Dual - Flow新型对抗攻击生成框架。它能从海量图像数据学“通用扰动规律”,对多模型、多类别发起黑盒攻击,为AI安全带来挑战,已用于蚂蚁数科产品。

机器之心
开源动态7

从大模型到多模态,图文混排Agent彻底起飞~

上周智谱多模态开源周,从GLM 4.6v到Autoglm,其图文并排使用场景很吸睛。上传PDF论文,它能生成图文混排解读文章,效果好。作者逆向原理复刻代码,还分享GLM 4.6V三个有意思的能力。

探索AGI
开源动态8

装机量超2000万、全球主流GPU与AI框架“开箱即用”!OpenCloudOS成AI时代优先选项

在大模型训练代快、算力需求高但 GPU 利用率低、生态碎片化的背景下,2025 OpenCloudOS 操作系统生态大会举办。OpenCloudOS 围绕 AI 升级技术,构建能力闭环,还发布智能基座,降低产业链技术摩擦。

InfoQ
产品应用7

Human In the Loop竟然可以是个MCP?

文章基于阿里实践,阐述如何在大模型研发平台OpenLM及其他Agent平台,针对“Human In The Loop”场景做产品设计与研发。介绍用MCP实现人机回路的方案,还探讨人类回答及提示词倾向性等问题。

阿里云开发者
产品应用7

实测完豆包Seedream 4.5,替我设计师朋友哭了

火山引擎推出图像创作模型Doubao - Seedream - 4.5,有强化原图保持、多图组合生成、优化海报排版与Logo设计等主打点。经实测效果不错,已全量开放API并公测,官方还给出生图tips。

量子位
算法论文8

碾压π0.5,复旦团队首创「世界模型+具身训练+强化学习」闭环框架

复旦团队针对当前 VLA 策略依赖模仿学习、真实机器人在线 RL 成本高、传统物理仿真器有局限等问题,提出 ProphRL 框架。该框架以世界模型 Prophet 为核心,结合 RL 算法,为具身智能落地提供更可行路径,实验效果显著。

机器之心