「AI大模型」共找到 14122 篇相关文章
大模型最后一层竟是推理累赘?绕开对齐税,奥数准确率暴涨 22.4%!
Qwen团队、清华和南洋理工研究打破传统认知,揭示‘对齐税’现象。提出Confident Decoding策略,在多架构和评测集实验中表现出色,开销低,挑战‘LLM最后一层最优’常识。
从输入指令到代码落地:Cline AI 源码浅析
文章从源码角度剖析 Cline AI 将自然语言指令转化为编程任务的过程,包括启动调试、前端输入、主进程处理、任务初始化、构建提示、模型请求等环节,指出核心是 prompt 组装和 tools 调用。
具身智能一步踏入Scaling Law!10B+基础模型,27万小时真实数据
AI机器人创业公司Generalist推出新型具身基础模型GEN-0,参数量10B+,专为多模态训练构建。该模型展现强大Scaling Law,能力可扩展,有和谐推理等特性,在多方面有突破,成果备受赞誉。
AAAI 2025 Oral | 火山引擎多媒体实验室提出VQ-Insight,AIGC视频画质理解大模型
火山引擎多媒体实验室与北大合作论文《VQ-Insight: Teaching VLMs for AI-Generated Video Quality Understanding via Progressive Visual Reinforcement Learning》入选AAAI 2026口头汇报。VQ - Insight用渐进式框架处理AIGC视频画质理解,实验表现卓越。
用AI把一段视频变成可视化网页,Google的新模型又卷飞了。
Google将Gemini 2.5 Pro更新为05 - 06版,此版代码能力在WebDev Arena盲测竞技场登顶,还提升视频理解能力,可将视频变成可视化网页,虽产品有不足,但模型进步值得肯定。
ICCV25 Highlight|格灵深瞳RICE模型狂刷榜单,让AI「看懂」图片的每个细节
格灵深瞳公司灵感团队自研的视觉模型基座RICE(MVT v1.5)刷榜多项视觉任务,在ICCV25获Highlight荣誉。它延续MVT系列理念,提升图片内部视觉特征差异性,在多任务验证中表现优异。
任意图像+视频=无限创意!港科大BiCo:AI视频进入组合时代,随意换角
BiCo是创新AI视觉内容生成方法,能灵活组合图像和视频视觉概念实现可控编辑。它解决现有方法在概念提取和组合上的问题,在多方面表现优异,可用于视频制作、艺术创作等领域。
Bug变奖励:AI的小失误,揭开创造力真相!
最新研究发现,AI的「创造力」并非额外能力,而是架构副作用。扩散模型本应是复制机器,却画出奇怪图像。研究者基于规则构建数学系统,证明了这一观点,还推测人类灵感或许同理。
7.3K Star!用 Orca 组建 AI 舰队:让 Claude Code 和 Codex 同时开工!
Claude Code 大火后,多家大厂推出自家 Code CLI,多终端操作上下文切换成本高。Orca 是开源 AI 编排器,可让多个 AI 编程助手并行工作,集中查看结果,有并行工作区、统一管理界面等亮点。
AI Agent的“祛魅与归真”:当超级智能体开始懂行|甲子光年
AI Agent正迎来“祛魅”时刻,市场关注焦点从“模型有多大”转向“业务有多懂”。甲子光年智库分析,其角色进阶为“数字员工”,重塑人机协作模式。众安信科深耕企业级场景,构建闭环体系,其AI Agent成效显著。