DeepSeek-Prover-V2-671B」共找到 655 篇相关文章

新闻资讯8

OpenAI深夜数连发:o3降价80%,o3-pro上线,奥特曼最后一次手发长文,开源模型却延期了……

OpenAI昨夜动作不断,o3模型降价80%,o3 - pro发布,开源模型延期。Sam Altman发长文《温和奇点》,预测AI发展时间线。o3价格虽降但使用成本仍有差异,o3 - pro性能强却推理慢,开源延期引发猜测。

AGI Hunt
新闻资讯7

AI遭遇灵魂拷问!这道题所有模型集体翻车,网友:我也不会啊

图像推理现新难题,在Reddit引发热议,目前无AI能真正解决。国内外支持图像输入的大模型答案不同,原因是对大立方体规格理解不同。结合提示多次尝试,部分大模型能找准方向,人类面对该问题也会困惑。

量子位
算法论文7

告别Reasoning模型的“灵光一现”,推理能力可控了

当前GPT - 4o、DeepSeek - R1等大模型推理的‘高级操作’随机触发,不可控。研究者受经典推理三要素启发,教会模型三种‘元能力’,经三阶段训练,模型效果提升,让推理能力可控。

深度学习自然语言处理
产品应用7

Kimi K3设计榜登顶焚诀公开:就藏在思维链里

Kimi K3在Design Arena单次生成前端榜单中夺冠。它做前端设计审美一流,靠独特思维链反复迭代优化方案,还具备强大数据索引能力。不过上线48小时因算力不足叫停新订阅。

量子位
产品应用7

Fable 5被网友薅出省钱神招!最高减70%!

网友发现把Fable 5上下文转成图片,让模型通过OCR读取,token输入成本最多省70%。方法pxpipe在GitHub获3000+STAR,本质是本地代理,还引出谷歌老论文及DeepSeek - OCR相关技术。

量子位
推荐文章8

第一章:AI 技术前沿全景

文章聚焦AI Agent技术前沿,阐述大语言模型三次能力跃迁,从涌现能力到对齐指令遵循,再到推理与行动。还提及Scaling Law变化,推理时计算扩展更划算,介绍代表性推理方案及多模态融合,指出Agent打破传统对话AI局限。

CourseAI
开源动态8

SGLang原生支持昇腾,新模型一键拉起无需改代码

12月20日SGLang AI金融π对收官,聚焦大模型推理效率。昇腾成SGLang原生支持后端,助DeepSeek等模型免调参运行。SGLang给出推理系统工程解法,昇腾与SGLang深度共建,性能优且全面拥抱开源。

量子位
新闻资讯7

全球十大AI杀入美股!最新战况曝光,第一名太意外

新加坡AI金融科技公司发起RockAlpha交易大赛,让GPT、Grok、DeepSeek等顶级AI在美国股市三大赛道实时交易,展示AI思考与博弈,各模型有不同表现,用户能与AI共做交易决策。

新智元
开源动态8

CapRL:用强化学习突破Image Captioning训练瓶颈,3B模型性能媲美72B

上海人工智能实验室联合团队发布 CapRL,首个将 DeepSeek - R1 强化学习策略用于 Image Captioning。CapRL - 3B 模型在图像描述任务媲美 Qwen2.5 - VL - 72B,已开源,团队持续迭代优化。

OpenMMLab
7

Sora2五天下载量破百万!超越ChatGPT增长速度,App Store免费榜霸榜第一

Sora2五天下载量破百万,增长速度超ChatGPT,在App Store免费榜霸榜第一。其虽有使用门槛,但热度高,盗版泛滥。不过它也面临版权问题,审核收紧。AI创意应用取代传统社交媒体速度加快。

量子位