「R1论文」共找到 2690 篇相关文章
让NCCL性能起飞的NCCL symmetric memory是啥黑科技?— part1
本文是NCCL 2.27新特性系列首篇,介绍symmetric memory。它类似NVSHMEM,现仅支持单节点通信,未来将支持跨节点。其低延迟内核能提升小数据通信性能,还介绍使用示例、CUDA内存管理及Symmetric Memory实现等内容。
DeepSeek V3.1 领衔,万字长文CodeBuddy AI Coding 企业落地实践思考
文章结合腾讯CodeBuddy IDE工具,为企业AI CODING落地提供指南。先诊断团队研发流程痛点,给出解决思路;介绍选择AI CODING工具的考量因素及CodeBuddy特色;阐述落地实践问题与应对,构建工作流,还提及使用价值、心得、产品思考与未来展望。
数学编码超越O3-high,英伟达版「DeepSeek R1二代」推理模型开源~
Nvidia开源OpenReasoning-Nemotron系列模型合集,采用Qwen2.5架构,基于500万条轨迹训练。评测输出长度最高64K token,多版本刷新SOTA。其‘heavy’模式有独特能力,32B版在数学与编程基准超越O3(High)。
DeepSeek R2没来,Kimi K2来了,VLLM,SGLang首发支持
Moonshot AI发布Kimi K2大语言模型,采用混合专家架构,总参数量达1万亿。其有多项技术创新,在多个基准测试表现突出。发布两版本,用修改版MIT协议开源,vLLM、SGlang首发支持,已上线多服务。
李志飞:1 个人、2 天做出 AI 时代的「飞书」,真正的 Founder Mode
出门问问创始人李志飞在「TicNote」发布会上分享「一人公司」实验。他用AI编程工具2天做出AI时代“飞书”原型,还谈了使用AI编程问题、对智能和Agent思考等,重新找回AGI信仰。
视频推理界的“福尔摩斯测试”:所有大模型,统统不及格 | 论文代码开源
腾讯ARC Lab和香港城市大学推出Video - Holmes,这是视频推理界的‘福尔摩斯测试’,能展现多模态大模型复杂视频推理能力的边界,规避现有Benchmark痛点,测试中所有大模型全部不及格,代码已开源。
斩获4.1K star,再见tcpdump!这款开源神器让网络分析快如闪电!
Kyanos是基于eBPF技术的开源网络分析工具,能透视Linux内核网络活动,解决分布式系统网络难题。它零配置、有内核级透视和智能流量解密能力,功能丰富,应用场景广,相比同类优势明显。
苏度 WAIC 首秀:从1到10+技能跃迁,探索通用机器人 Scaling 路径
WAIC 2026上,苏度科技机器人展示了抓取物品等技能,稳定性等表现出彩。苏度成立一年获200亿估值,其创始人苏昊等技术实力强。它构建能力积累体系,采用虚实融合数据路线,坚持软硬件一体,多场景落地成果佳。
1.4K Star!不要问答,要完成任务,一个合格的金融Agent应该是什么样?
过去一年AI Agent火热,但金融场景投研是长链路任务,有诸多硬约束。LangAlpha是Ginlix AI推出的开源金融Agent项目,能解决实际金融研究任务,有核心架构和关键能力,还给出使用方式、典型Demo及横向评测。
AI生成的图片正在反向对齐人类的审美?ICML 2026观点论文Spotlight
UBC和Weathon Software研究指出,图像美学对齐削弱艺术表达。开发者用评估模型让图像生成模型产出符合人类审美的图片,但这导致图片同质化,限制艺术多元性,作者还提出六个相关担忧,并做多项测试验证。