创作者榜单」共找到 738 篇相关文章

算法论文7

剑桥揭开大模型翻车黑箱!别再怪它不懂推理,是行动出错了

剑桥大学等机构研究指出,大模型执行长时任务易翻车,问题不在推理而在执行能力。研究人员评估多个指标,发现步准确率提升可让任务长度指数增长,还研究了自条件化等影响及模型规模的作用。

新智元
推荐文章7

图解Vllm V1系列7:使用AsyncLLM做异步推理

文章因异步RL讨论热,探讨用vllm做最小程度异步二次开发。介绍如何用AsyncLLM做异步推理,分析条请求处理流程及阶段,说明并发提升效率的方法,还提及多请求并发及构建异步推理引擎思路。

GiantPandaLLM
新闻资讯7

公司业绩大爆发,芯片大佬身家逼近两百亿

在《2025新财富500创富》中,瑞芯微大佬励民身家173.8亿成福州第二富豪,财富较去年涨73%。他2001年创立瑞芯微,多次带领转型。近年公司业绩佳,但大股东抛减持计划,且面临行业风险。

芯师爷
开源动态8

爆火的腾讯WorkBuddy发了篇论文,公开了自家底牌

腾讯 WorkBuddy 团队将内部模型选型评测等开源成 Benchmark,公开多模型 Agent 工作台选型底牌。Bench 优点是任务分布真实且开源可审计,论文介绍了核心方法论、四大赛道拆解、结果,还对比了现有工作。

PaperAgent
新闻资讯7

Runway重夺全球第一!1247分碾压谷歌Veo3,没有千亿算力也能干翻科技巨头

Runway Gen - 4.5击败谷歌Veo3,以1247的ELO分数在Artificial Analysis中重夺AI视频王座。它在多方面树立新标杆,虽有局限,但创始人认为其是通用模拟引擎,应用场景广泛。

新智元
开源动态8

GLM4.5之后,智谱又开源GLM-4.5V,实测下来视觉推理能力贼强~

智谱继GLM4.5后又开源GLM - 4.5V,它是同级别开源SOTA视觉推理模型,在多模态理解表现优异。文章实测其在科研全生命周期的应用,还介绍了模型架构设计和训练策略。

PaperAgent
新闻资讯7

快来看看GPT-5第一波实测

GPT-5发布引全球关注,50万粉Youtuber Matthew Berman用25分钟视频展示其近30个任务表现,如做出魔方生成器、复刻网页版Word和Excel等。它多项能力有提升,但也有不足,被马斯克质疑,还因‘52>69’名场面遭吐槽。

量子位
新闻资讯7

马斯克终于成『AI No.1』,6大案例看实力与水分

马斯克发布Grok 4,宣称其超越OpenAI等LLM。它屠了各种,但Grok系列口碑欠佳。文中通过多案例测试,展现其在各方面的表现,如编码、数学、图像等,还提到了API速度和价格。

鲸选AI
技术文章7

让NCCL性能起飞的NCCL symmetric memory是啥黑科技?— part1

本文是NCCL 2.27新特性系列首篇,介绍symmetric memory。它类似NVSHMEM,现仅支持节点通信,未来将支持跨节点。其低延迟内核能提升小数据通信性能,还介绍使用示例、CUDA内存管理及Symmetric Memory实现等内容。

GiantPandaLLM
产品应用8

实测可灵AI的新视频模型,它生成的动作戏酷到封神。

作者实测可灵2.5新视频模型,它已灰度内测并登上釜山电影节。与可灵2.1对比,可灵2.5在运动和表演能力上大幅提升,还增强了文生视频与理解能力,让创作者有更多创作自由。

数字生命卡兹克