「四段式预训练」共找到 2350 篇相关文章
ICRA 2026|NUS邵林团队提出T(R,O) Grasp:刷新跨智能体灵巧抓取SOTA,实现5FPS动态环境交互
新加坡国立大学邵林团队提出T (R,O) Grasp,这是基于物体—机器手空间关系建模的图扩散架构,有跨智能体统一表征能力,在多种智能体上平均抓取成功率达94.83%,刷新跨智能体灵巧抓取SOTA。
打破视觉Token的算力诅咒,RedundancyLens如何为多模态大模型推理减负
多模态大模型的 Decoder - only 架构处理视觉 Token 有计算冗余。合合信息团队提出无需额外训练的动态计算削减方法,在不影响性能前提下降低推理成本,适用于多场景。
探访丨媒体记者走进首钢园,2026中国科幻大会3月27日开幕
2026中国科幻大会3月27日至29日在首钢园举办。开幕式在四高炉举行,有三个“首次”亮点。同期举办北京国际科幻与未来产业博览会,还有科幻嘉年华等活动。“幻幻”机器人不断进化。
拒绝重复造轮子!抽象 80% 工作场景,打造可复用的"AI 助手工厂”
文章指出,为解决重复开发AI助手的效率问题,智空间团队将高频需求抽象为可复用技术方案,打造“AI助手生产线”。介绍四大高频场景本质、共性挑战及对应方案,还阐述分层架构、解决方案、prompt架构等,最终落地“助手工厂”产品。
执行力通货膨胀的AI时代,什么才是你真正的资产?
在AI时代,执行力正在通货膨胀,劳动市场估值逻辑改变。文章指出判断力、品味、信任资本、意义感将成为稀缺资产,因AI在这些方面有局限。还给出提升这些能力的行动建议。
不止修bug:Agentic Coding评测走向复杂feature交付新阶段
中国科学院自动化研究所联合华为提出 FeatureBench,构建端到端基础设施并开源。它从单元测试出发构造评测任务,引入多种机制保障任务可执行、可验证,能有效区分模型能力,还提供易用的评测流程。
ICLR 2026 | 7B小模型干翻GPT-5?AdaResoner实现Agentic Vision的主动「视觉工具思考」
文章介绍了AdaResoner模型,它学会‘何时用工具’,在拼图推理上击败GPT - 5。Google为Gemini 3 Flash引入‘Agentic Vision’,与AdaResoner殊途同归。AdaResoner有独特训练方法,提升小模型性能。
清华刘知远团队论文:最小化结构改动,短文本到长文本丝滑升级 | ICLR 2026
大语言模型发展中,上下文长度成关键瓶颈,主流架构计算开销大。清华刘知远团队提出《InfLLM-V2: Dense-Sparse Switchable Attention for Seamless Short-to-Long Adaptation》,提出可切换注意力框架,为长上下文研究提供新思路。
上线120小时,Moltbook全球瘫痪!150万AI服务器已炸?
火遍全球的Moltbook上线120小时就瘫痪,服务器账单高得离谱。刚被扒皮150万AI多数是人类假扮,其还存在大量安全漏洞,OpenClaw耗token严重且接管电脑危险大。
2026 年,全球 CEO 对 AI 的态度,集体变了
普华永道第29届全球CEO调查显示,CEO们对短期增长信心下降,担忧宏观经济等威胁,但仍大力推进AI投资。多数企业AI投入未获财务回报,不少企业跨界探索,CEO需兼顾当下与未来。