「高性能Kernel」共找到 3435 篇相关文章
万亿思考模型夺下IMO金牌,无缝接入OpenClaw!一句话手搓丐版PS
2026年AI圈竞争激烈,闭源巨头巅峰对决时,开源社区迎来中国队的「技术核爆」。全球首个万亿级混合线性「思考模型」Ring - 2.5 - 1T开源,它能力强大,还能无缝接入Claude Code,实战表现亮眼。
LLM算力告急?把文本变图片,推理成本直接减半!
大型语言模型处理长文本时计算成本高,本论文探索‘文本即图像’输入压缩策略,将长文本渲染为图像输入多模态模型,可减少近一半令牌,且任务性能不受显著影响,在多任务中验证了其有效性。
精打细算虾养成指南: 省 Token 和把 AI 用好,从来就是一件事
文章指出用AI时Token成本高、模型变笨,原因是上下文管理不善。介绍了省Token和用好AI的方法,如按需取上下文、明确约束、多智能体协作、按阶段切换模型等,核心是在合适时间将合适上下文装入合适模型。
9.7K Star 把 AI 编码的 token 消耗砍了 16 倍
当前AI编码工具默认读取整个项目文件,token消耗高。code-review-graph项目用Tree-sitter解析代码库成图,追踪改动“爆炸半径”,平均省8.2倍token,技术轻量,还能做社区检测。它揭示AI编码瓶颈在信息输入质量。
PPO-Clip的「盲点」被补齐了?快手提出熵比裁剪方法,从局部约束到全局稳定的关键一跃
快手科技语言大模型团队提出熵比裁剪(ERC)方法,应对强化学习中信任域偏离问题。该方法从全局视角稳定策略分布,在多个数学推理基准实验中提升了模型性能,还与多种方法对比验证了泛化能力。
Seedance 2.5 抽卡老废片?专业团队的 4 层控制法
Seedance 2.5上线后,单条画质好但成片易散架,废片率高。文章将官方提示词指南和一线分镜写法整合成四层控制框架,还给出30秒短剧分镜示例,助你定位问题、提高抽卡效率。
Palantir活成了所有FDE羡慕的模样:被骂十年外包,股价一天暴涨29%
8月3日美股盘后,Palantir交出2026年二季报,业绩亮眼致次日股价涨29.45%。此前它被看空,因其交付方式被指像外包。但从财务看它利润率高,且业务增速快,不过高估值和国际业务仍存挑战。
基于 Qwen3-VL-Embedding-8B 实现文搜图语义内容检索的实战教程
文章围绕Qwen3-VL-Embedding-8B模型展开,介绍其核心特性、技术架构等,提供环境搭建、模型部署指南,给出文搜图系统架构及代码实现,还通过电商、社交媒体、企业文档三个实战案例展示应用,最后讲解性能优化与常见问题解决方法。
AAAI 2026|AP2O-Coder 让大模型拥有「错题本」,像人类一样按题型高效刷题
在AI辅助Coding技术发展背景下,开源大语言模型生成代码有运行错误。上交博士团队提出AP2O方法,构建AP2O - Coder框架,借鉴人类学习模式,经实验验证能提升模型性能、抑制错误、提高样本效率,还适配通用模型。
DeepSeek,Qwen,Grok组团发布,社区一手实测
LLM大爆发,一天内推出Grok 4.6、Qwen3.8 - Max、DeepSeek - V4 - Pro - 0813三款前沿产品。社区对它们进行多场景测试,如3D场景、Flappy游戏、飞机滑行动画等,并对比了不同模型的性能、价格和输出质量。