推理模式」共找到 2841 篇相关文章

开源动态7

1200行代码逆袭!DeepSeek工程师开源轻量级vLLM,吞吐量逼近原版

开源 vLLM 可提升 LLM 推理速度和资源利用率。近日,DeepSeek 工程师俞星凯开源轻量级 Nano - vLLM,代码仅 1200 行,基准测试中吞吐量逼近原版,项目已在 GitHub 获 200 多 Star。

机器之心
新闻资讯8

截击英伟达!OpenClaw狂吞Token,北大系芯片黑马剑指2000 Tokens/s

NVIDIA GTC 2026前夕,AI推理赛道竞争激烈。北大系寒序科技宣布融资,首颗样片测试跑通,单位面积带宽达100GB/s/mm²,下一代「MRAM+SRAM」架构目标2000 Tokens/s,挑战英伟达。

新智元
开源动态7

11 万 Star 的开源项目,给 AI 编码代理补流程,这套 Superpowers 值得装

110多K Star的开源项目Superpowers,是完整软件开发工作流程,基于17个可组合“技能”。它采用Pull模式,用苏格拉底式追问澄清需求,工作流覆盖多领域,支持多平台,一行命令即可安装。

AI进修生
产品应用7

Claude Code 推出语音功能,但是,不支持中文

Claude Code推出语音模式,向约5%用户开放。用户按住空格说话,系统自动生成文本,支持语音与键盘混合输入,能提高录入效率,但大概率不支持中文。此外,电报率先支持OpenClaw流式实时回复。

AGI Hunt
产品应用8

实测腾讯Hunyuan-Image2.0,首个毫秒级实时图像生成模型

今天上午腾讯发布混元图像2.0,以“更智能、更开放、更中国”为理念。其参数规模提升,推理时间大幅压缩,实现毫秒级实时生成,还在画面质量等方面升级,新增实时绘画板功能。

带你学AI
开源动态8

DeepSeek开源的文件系统,是如何提升大模型效率的?

2月28日,DeepSeek开源高性能分布式文件系统3FS以解决人工智能训练和推理挑战。介绍了分布式文件系统优势,深入解读3FS的组件、CRAQ协议等,还探讨其与其他系统差异及性能相关问题。

机器之心
新闻资讯7

OpenAI「自首」!联手MIT证明:ChatGPT用得越多越孤独

OpenAI联合MIT进行四周随机对照实验,追踪981名受试者超30万条聊天消息。结果显示,ChatGPT用得越多,人越孤独,信任度越高伤害越深,语音模式长期副作用大,超120万用户心理亚健康。

新智元
新闻资讯7

Pony Alpha新模型炸场!全球「猜爹大赛」开启

2月7日深夜,OpenRouter悄悄上线匿名模型Pony Alpha,其编程、推理等体验出色,外网瞬间疯传。全球开启‘猜爹大赛’,Claude、DeepSeek、Grok、GLM各派开吵,还凸显了‘匿名盲测式发布’新打法。

新智元
算法论文8

免训练加速61倍!陈怡然团队新作DPad:仅关注「彩票token」

杜克大学陈怡然团队新作DPad,发现扩散大语言模型关注少量「中奖」token,推理速度可提61 - 97倍,还增强模型语境学习能力。DPad免训练零成本挑关键信息,实现「少算多准」。

新智元
推荐文章7

Cursor 的困境:它真的找到 PMF 了吗?

知名投资人 Chris Paik 探讨 Cursor 困境,指出其依赖的‘无限使用’订阅模式易致成本与收入失衡。分析了商业模式与产品匹配的重要性,认为补贴非商业模式,Cursor 需明确用户需求本质。

Founder Park