「全模态推理」共找到 3761 篇相关文章
Karpathy氛围编程最新指南!三层AI编程结构:顺境Cursor,逆境Claude,绝境GPT-5 Pro
大神Karpathy发布全新Vibe Coding指南,总结出AI编程三层结构:Cursor负责自动补全与小修改,Claude Code/Codex实现大功能块,GPT - 5 Pro解决难题。该指南是对Vibe Coding概念的升级。
狂肝一周,测评十余款 PPT AI 生成产品的真实反馈
评估 Agent 产品能力复杂,以 PPT 生成为例,有 Agent 和模板化两种流派。作者选前者投票测评、后者全方位测试。给出方案,还推荐不同需求适用产品,附总榜单和细致体验描述。
唯快不破:上海AI Lab 82页综述带你感受LLM高效架构的魅力
大语言模型性能提升但成本高,制约落地应用。上海AI Lab联合多家机构总结440余篇论文,形成82页综述,将LLM高效架构分为7类,探讨最新进展,还涉及线性化技术、硬件实现等内容。
视频生成 vs 空间表征,世界模型该走哪条路?
随着生成模型和潜在表征技术发展,业界探讨世界模型技术路线。是像素级视频预测模拟未来场景可靠,还是潜在空间抽象表征高效?Goole DeepMind的Genie 3发布,再次引发讨论,分歧也从理论走向应用。
训练提速5倍,响应缩短50%:动态自感知能力,重塑高效LLM Reasoning范式
大型语言模型“思维链”技术有冗余,传统优化方案存在静态先验与动态能力错配问题。论文提出的DR.SAF框架赋予模型动态自感知能力,通过三模块协作,实现推理“精准瘦身”,解决根本冲突。
Make SFT Great Again!从SFT到DFT:一权重之差,泛化之跃
大型语言模型的监督微调(SFT)简单高效,但泛化能力弱于强化学习(RL)。本文直击 SFT 核心缺陷,揭示其泛化瓶颈源于隐含的“病态奖励结构”,并提出仅需单行代码修改的动态微调(DFT),实验表明其效果显著。
汽车MCU的“芯”浪潮
在汽车产业变革下,汽车MCU作为核心控制部件迎来创新升级。AI浪潮让其算力狂飙,架构革新提升集成度,同时安全成新重点。未来,汽车MCU将更智能高效,融合AI、创新架构、重视安全。
AI正在掏空大脑,思想沦为残废!未来只分AI的「主人」和「奴隶」
全世界为AI疯狂,它虽提供“认知捷径”,但长此以往并非好事。Section公司CEO Greg Shove分享使用AI经历,指出未来知识工作者将分化为“AI驾驶员”与“AI乘客”,并给出成为AI主人的方法。
这家国内公司,在给具身智能技术栈做「通解」
具身智能是AI热门赛道,世界人工智能大会WAIC 2025让其概念渐明。国内梅卡曼德公司展位集合机器人技术多种落地形式,展示自研通用机器人「眼脑手」全栈技术产品,推动机器人各行业落地。
大模型竞赛转向:决胜关键为何是“后训练”?|甲子光年
大模型价值主战场向后训练转移,Grok 4凭后训练成“宇宙最强”。产业应用中通用模型适配难,后训练方法也在进化,如采用SFT+RL等,还介绍了夸克和阿里云的后训练实践。