「逻辑关系」共找到 585 篇相关文章
CUTLASS CuTe GEMM细节分析(三)——Swizzle<B, M, S>模板参数的取值
文章以(8, 32):(32, 1)为例,探索确定Swizzle<B, M, S>中M、S和B参数的方法。指出M、S与PTX指令及共享内存多Bank结构相关,B用于指定Swizzle行数避免bank conflict,还给出不同Layout的参数取值。
会“思考”的目标检测模型来了!IDEA提出Rex-Thinker:基于思维链的指代物体检测模型,准确率+可解释性双突破
现有目标检测方法有决策不透明和拒识能力不足问题。IDEA提出Rex - Thinker,引入“逻辑推理链”,构建可解释推理框架,经两阶段训练,在测评中准确率提升,可解释性强,有良好泛化能力。
AI音乐赛道单笔最大融资:ACE完成4000万美元Pre-B轮 | 5Y News
AI音乐生成赛道竞争聚焦于‘谁更可控’,ACE团队由郭靖创立,既推出专业音乐制作工具ACE Studio,又面向大众打造Miya平台。公司获4000万美金Pre - B轮融资,欲构建覆盖全流程的音乐平台。
Loss收敛不代表学会:腾讯混元ACL 2026拆解SFT训练中15.3%的“假学会”样本
大模型微调(SFT)是主流LLM落地方案,但大家默认训练完就是学完了。腾讯混元团队发现SFT存在不完全学习现象(ILP),论文完成了定义ILP、找根因、提诊断框架和验证干预等工作。
Pinterest 利用内容指纹技术,在数百万个域名中实现 URL 去重
Pinterest工程师开发“最小重要查询参数集”(MIQPS)URL标准化系统,用于优化大规模数据采集管道内容去重。它取代传统方法,用数据驱动判断参数重要性,还采用早期退出逻辑等提高效率。
Boris Cherny:Claude Code 之后,写代码正在变成“管理 Agent”
这是对Anthropic内部Claude Code创建者Boris Cherny的访谈。他介绍了Claude Code从三人孵化项目发展的历程,分享工作流,探讨编程现状、SaaS未来、产品与模型关系等,还给出软件大众化等观点。
没有KPI,也能领先OpenAI?从“内部观察者”视角看顶级AI实验室如何运作
InfoQ采访《哈萨比斯:谷歌AI之脑》作者塞巴斯蒂安·马拉比,从“内部观察者”视角解析DeepMind成长逻辑,探讨其与OpenAI、Anthropic差异,还谈及AI竞争格局、组织模式及资源配置等问题。
Karpathy 用 AI 给全美 342 个职业打了分: 程序员,律师最危险...
Andrej Karpathy上线项目karpathy/jobs,爬取美劳工统计局342个职业,用LLM打0-10分展示AI暴露程度。如程序员、律师暴露高,屋顶工等低。介绍了数据处理流程、可视化逻辑及额外用法。
数据邪修大法好:仅用文本数据就能预训练多模态大模型
多模态大模型研发中,行业认为无图文对就无多模态能力。但ReVision研究表明,预训练阶段昂贵配对关系非必需,利用非配对数据统计信息修正文本表征,能实现跨模态互换,降低成本。
几句话就能复刻一个付费Skill,Skills商店还能卖什么?
文章探讨Skills商店的生意前景,介绍应用层转变,对比Skills与Agent商店,说明Skills来源,指出简单流程型Skills易被复刻,还阐述Sklls、MCP、A2A的关系及当前Agent存在慢的问题。