「技术收敛范式」共找到 3648 篇相关文章
Discrete Tokenization:多模态大模型的关键基石,首个系统化综述发布
近年来,人们关注将LLM能力扩展至非文本模态,Discrete Tokenization成关键方案。但现有研究缺系统总结,香港科技大学等团队发布首个相关系统化综述,梳理技术脉络、方法及挑战,给出未来研究方向。
至简动力交付百台「开箱即用」机器人,加速具身量产节奏
2026年7月6日,至简动力宣布完成首批百台i7 Pro机器人交付,落成CNC智能化产线。其产品定位‘开箱即用’,适配多场景。但行业仍处早期,至简面临跨场景成本、数据飞轮、产能等问题待解。
告别纯奖励试错!二次尝试+反思蒸馏,复杂任务提升81%
美国南加州大学和宾夕法尼亚大学团队提出新训练范式ERL,将「经验学习」引入强化学习,通过二次尝试和反思蒸馏,在复杂任务中性能显著提升,为构建长期自主智能体提供新思路。
《多模态大语言模型技术发展报告》正式发布 | 中科算网算泥社区
2月5日,中科算网算泥社区发布《多模态大语言模型技术发展报告》。报告回顾多模态大模型发展历程,剖析核心技术创新,展示应用实践,分析挑战与机遇,为各界提供参考,推动多模态AI技术发展。
四问智谱上市|甲子光年
2026年1月8日,智谱AI在港交所上市。本文围绕其上市提出四问:是否为“中国OpenAI”、投资人押注点、商业模式健康度及“钱路”方向。指出它应卸下标签,回归技术与商业本质。
谢赛宁REPA得到大幅改进,只需不到4行代码
Adobe Research等团队对REPA展开研究,发现驱动目标表征生成性能的是空间结构而非全局性能。基于此构建iREPA,代码不到4行,能提升REPA收敛速度,在多方面表现出色。
最好的 DeepResearch 平替开源了
ROMA是元代理框架,以递归分层结构解决复杂问题,有并行问题解决、透明开发等优势。它通过计划 - 执行循环处理任务,介绍了安装选项、技术栈,还有预构建代理展示功能。
在全球 AI 的惊天变局中,为何越想独立,越要开放?
在科技巨头主导AI风向的当下,人们对数字命运的掌控感到焦虑,催生了主权人工智能概念。《主权人工智能现状》报告揭示,追求AI主权成全球共识,其核心驱动力有四,实现路径是开源,同时也面临挑战。
Agentic Web:AI Agents如何重塑下一代互联网,一个到处是待研究与落地的方向
论文《Agentic Web: Weaving the Next Web with AI Agents》描绘颠覆性未来,AI 智能体成“数字代理人”,互联网将从“连接信息”向“执行行动”转变。论文给出构建下一代智能互联网路线图,剖析挑战、展示场景并预警风险。
挑战扩散自回归统治!字节提出视觉生成第三种路线,让模型像人类一样边画边改
五一期间字节商业化技术团队研发出新一代视觉生成模型,其底层架构是全新的第三条路——生成精炼网络GRN。它能让AI像人一样边画边改,解决了现有模型的问题,在多项基准测试中刷新SOTA记录。