DeepSeek-V3.1」共找到 3673 篇相关文章

产品应用7

李飞飞World Labs双模齐发,能「造」超复杂大场景,一手实测

李飞飞的 World Labs 推出 Marble 1.1 和 Marble 1.1-Plus 两款模型。Marble 1.1 提升视觉效果,Marble 1.1-Plus 能生成更大更复杂场景。官方建议初用选 Marble 1.1,创建大场景用 1.1-Plus,还给出了实测和网友案例。

机器之心
开源动态7

3.1w颗星!一条命令,克隆任意网站

此项目只需给AI编程代理一个URL,就能将网站重建成Next.js应用。介绍快速开始步骤、支持平台、前置要求、技术栈、工作原理、常用命令及项目地址等。

GitHubStore
开源动态8

救命! Canvas?3.1k Star Mind Elixir ,真丝滑!!!!

Mind Elixir是可嵌入的JavaScript脑图内核,零依赖、框架无关。它能将JSON数据变成可交互节点,有拖拽、编辑等功能。适合知识库等场景,不适合只需不可编辑宣传图等场景。

小华同学ai
新闻资讯7

Kimi K2里找到了DeepSeek V3架构

Kimi新模型K2热度高,在多benchmark上达SOTA,网友好评多。Kimi工程师透露K2开源原因,还谈及Kimi发展策略。实测显示K2在前端制作、工具调用、创意写作上表现出色。此外,OpenAI开源模型推迟,引发猜测。

量子位
新闻资讯7

确认!DeepSeek多模态AI已经开测

DeepSeek研究员陈小康、陈德里确认其V4视觉模式开始灰度测试。更新后出现识图模式,具备真实图像理解能力。陈小康是多模态研究组负责人,陈德里负责语言模型等核心方向,V4可谓满血归来。

量子位
产品应用7

Deepseek是被降智了吗?

作者认为Deepseek被降智,存在诸多问题,如不懂用户意图、长文理解差、措辞怪异、提示词调教难、无脑捧杀、幻觉率高、深度思考弱等,还对比了与GPT在人际交往话题回复上的差异。

深度学习自然语言处理
算法论文7

deepseek-V4算法工程技术深入浅出

文章围绕deepseek V4技术报告展开,指出当前大模型训练不充分,介绍了算法层面如混合注意力机制、模型结构优化、优化器等,工程层面如细粒度专家并行、算子内核开发等,以及后训练的范式转变和领域专家网络蒸馏等内容。

Agent的潜意识
新闻资讯7

AI 太烧钱!微软选择「倒戈」DeepSeek

微软宣布Copilot Cowork全球上线并引入按使用量计费机制,还评估引入DeepSeek V4。Agent普及使AI成本问题凸显,微软进行系统性重构,构建质量保障体系,成本工程化能力成竞争新焦点。

AI科技评论
产品应用8

Genie 3,让幻觉持续成为现实

Google最新发布的Genie 3能从文本生成交互式世界,实现24fps实时交互,分钟级一致性,720p分辨率。它取长补短,有出色记忆能力,物理表现自然,还能让智能体完成任务。不过目前是有限预览,有不足。

AGI Hunt
产品应用8

Qwen3.7:智能体新前沿

阿里云正式发布面向智能体时代的Qwen3.7-Max模型,将通过API提供服务。它能力全面,编程、办公、长周期执行等表现出色,适配多框架,在多场景评测中领先,能驱动生产力跃升,还经多实战测试验证实力。

千问大模型