「DeepSeek V3.1」共找到 3894 篇相关文章
GPT6来了,我却怀念GPT3.5
作者看到群里说ChatGPT等AI工具无法使用,意识到人们已离不开AI。接着提到GPT6发布,其各项测评指标比上一代大幅提升。还探讨了GPT6到来后SEO、GEO的意义及未来研究方向。
用DeepSeek网页版就能瓜分鹅厂600万??!
腾讯营销以KDD Cup 2026官方赛道身份出题,聚焦推荐系统统一建模,奖金600万+。全球众多选手参与,学术和工业赛道各有冠军方案,还设创新奖。赛事也推动了鹅厂人才培养体系的拓展。
3万字长文带你WorkBuddy 从入门到精通
这是 WorkBuddy 的「从入门到精通」指南。介绍了它在 Windows 和 Mac 上的安装、登录、更新方法,功能涵盖新建任务、助理页面、项目页面等。还讲了技能、连接器、专家中心的使用,以及自动化、资料库、灵感等功能,还有实践案例、使用技巧和常见问题解答。
从0到1带你速通 Marvis马维斯
AI 时代,Agent 产品虽强但普通用户使用门槛高。本文详细介绍腾讯 Marvis,它能让 AI 直接理解电脑,可执行多项任务。作者实测 6 个任务展示其功能,认为它是面向普通用户的系统级 AI 管家。
Google这个1.5w star 项目牛皮,99%准确率!
Google安全团队开源AI文件类型检测工具Magika,抛弃固定规则匹配,用深度学习精准识别文件真实类型。它内置轻量模型,单CPU毫秒级推理,支持200+格式,准确率约99%,已大规模落地。
3天霸榜GitHub Trending,这个群体智能体能预测万物
MiroFish是基于多智能体技术的AI预测引擎,可构建平行数字世界推演未来。它前身BettaFish曾爆火,作者受其启发开发此项目。文中还介绍了工作流程、部署方式及项目地址。
1美元时薪?这才是打工人的「梦中情模」
Anthropic 的 Opus 4.6 好用但贵,MiniMax 推出 M2.5 与之抗衡。M2.5 在多方面表现卓越,参数量小,成本低,推理速度快,还经实测能成打工人得力助手,其背后有独特训练体系。
灵码+Qwen3-Coder——使用Skill机制实现代码审核
本文探讨在灵码内使用Claude Skills能力,介绍其实现机制、灵码适配方案。还以代码审核场景为例,展示自定义Skill的创建方法,总结Claude Skills优势及应用场景,展望其与MCP的发展前景。
【DeepSeek-OCR系列第一篇】Language Modelling with Pixels【ICLR23】
当前主流语言模型依赖固定词表,扩展到多语言、多脚本时面临覆盖受限、计算昂贵、鲁棒性差等问题。ICLR 2023论文提出不依赖词表的PIXEL模型,通过将文本变成图像用视觉Transformer理解,实验验证其有跨语言、抗噪声等优势。
训练MoE足足提速70%!华为只用了3招
Scaling Law下,MoE成扩展模型能力法宝,但训练难题凸显。华为构建Adaptive Pipe & EDPB优化方案,还打造DeployMind仿真平台,解决了MoE训练中通信等待、负载不均等问题,使训练吞吐提升72.6%。