DeepSeek Harness」共找到 787 篇相关文章

算法论文8

突破显存瓶颈:基于 DeepSeek-V3.2-Exp 的 Latent Cache 卸载预取方案设计与模拟验证

百度百舸AIAK团队针对DeepSeek-V3.2-Exp,设计基于Latent Cache的卸载预取方案ESS。该方案解决显存瓶颈,提升Decode吞吐并降低成本,经模拟验证效果显著,未来将拓展应用。

InfoQ
开源动态7

DeepSeek-R1今天一次「小更新」,颠覆了大模型格局,网友:尽快放R2

昨晚,DeepSeek官方宣布其R1推理模型升级到最新版本(0528),并公开模型及权重。该版本参数量高达6850亿,采用MIT许可证,性能提升明显,在多个基准测试中成绩优异,网友实测代码能力也大幅提升,但仍存在过度思考问题。

机器之心
开源动态8

两周复刻DeepSeek-OCR!两人小团队还原低token高压缩核心,换完解码器更实用

两人小团队仅用两周复刻DeepSeek-OCR,复刻版DeepOCR还原其低token高压缩核心优势,还在关键任务上追上原版表现。它完全开源,无需大规模算力集群,训练方案适配中小团队。

量子位
推荐文章7

AI Coding 的下一步不是写得更快,而是可验收:蚂蚁数科 Harness 工程实践

蚂蚁数字科技资深技术专家魏长征在AICon大会分享AI Coding实践。指出当前产能提升快,但验证能力可能跟不上,容易引发质量风险。介绍了Harness工程思路及在新项目和存量项目中的应用,还提及AI协作的未来挑战。

InfoQ
新闻资讯7

DeepSeek 为什么把缓存涨了 11 倍?长上下文需求暴涨,得交点「存储税」了

8月17日,DeepSeek V4 Pro API输入和输出价格上涨,空闲时段缓存命中价涨5倍,高峰时涨11倍。此前其因高缓存命中率成性价比之选,但长上下文需求爆发致后端“缓存颠簸”,只能通过涨价收“存储税”。开发者可提高缓存命中率应对。

AI科技评论
产品应用7

DeepSeek R1代码能力直逼Claude 4!附生成任何优质网站的通用提示词

作者体验DeepSeek R1超8小时,发现其文本写作问题大幅修复,思维链推理改进,代码能力提升,前端审美直逼Claude 4。文章展示其前端能力,给出写前端网页提示词及设计逻辑,还探讨了其在复杂任务中的表现。

花叔
开源动态8

SGLang Team:在 96 个 H100 GPU 上部署具有 PD 分解和大规模专家并行性的 DeepSeek

本文介绍 SGLang 团队在 96 个 H100 GPU 上部署 DeepSeek 的方法。利用 PD 分解和大规模专家并行性,SGLang 实现高吞吐量,成本低。博客探讨并行设计、优化方法,所有组件开源,也指出了当前局限与未来方向。

GiantPandaLLM
新闻资讯7

360 周鸿祎:做中国版 Mythos 不能照搬美国路线,基模能力的差距可以通过Harness补齐

过去几月,Anthropic的Mythos模型成全球网络安全焦点。360周鸿祎在ISC.AI 2026上发布‘图龙锋’和‘仪天阵’,欲做中国版Mythos,还发起‘磐石之盾’计划。他认为不能照搬美国路线,可通过Harness弥补基模差距。

InfoQ
产品应用7

DeepSeek识图模式是个新模型?!一手实测在此(没错我被灰度到了)

作者喜提DeepSeek识图模式灰度测试,实测发现其非思考模式速度快,推理有幻觉;思考模式推理慢且冗长。实用功能如OCR、复原HTML较靠谱,但色盲测试偶翻车。该模式或用独立视觉模型,且多模态进展超预期。

量子位
算法论文8

融资 1200亿后 Kimi 再扔王牌,新架构爆改 Transformer 老配件,比 DeepSeek 同款还省钱

Kimi 发布新论文,提出“注意力残差”架构改进 Transformer 残差连接,解决“稀释问题”,让 AI 更聪明、更省钱,还推出“分块注意力残差”优化成本。与 DeepSeek 方案对比,Kimi 方案性价比更高。

AI前线