DeepSeek-V3.1」共找到 3685 篇相关文章

开源动态8

开源首月斩获 1K+ star!大学生开发web终端工具,颜值高、功能强,真吊啊~

传统远程终端工具存在界面单一、功能有限等问题。大学生开发的开源Web应用Nexus Terminal,集成SSH等三大协议,有多重安全机制,适合中小团队运维等,开源首月获1K+ star。

开源先锋
7

刚刚DeepSeek宣布大规模扩张,整体至少扩员一倍,全体岗位集体喊人加入

DeepSeek宣布大规模扩张,各部门规模至少扩一倍。其发力点包括底层算力与系统优化、高质量数据、Agent与应用落地及探索Next Level科研。用人反内卷、反官僚,岗位接受实习,还新增AGI核心业务管培生。

AI寒武纪
新闻资讯8

3亿美金种子轮!ChatGPT大神联手DeepMind牛人,要造一个真正的“AI科学家”

9月30日,OpenAI的ChatGPT创造者之一William Fedus和谷歌DeepMind的GNoME项目负责人Ekin Dogus Cubuk成立Periodic Labs,获3亿美元种子轮融资。公司要创造“AI科学家”和自主实验室,从物理科学切入,解决超导、半导体等领域问题。

AIGC开放社区
产品应用8

Qwen3-Embedding 全揭秘:从技术到服务,打造高效AI产品的关键路径

文章全面揭秘 Qwen3-Embedding,介绍其核心原理、优势、应用场景。还给出在 PAI 和百炼平台的使用方法,含部署、推理、微调等。通过对比实验,凸显其低延迟、低成本特点,未来将成语义理解核心设施。

阿里云开发者
开源动态8

原生理解生成统一:商汤开源SenseNova U1,用统一架构终结「缝合怪」多模态

商汤开源日日新 SenseNova U1 系列原生理解生成统一模型,采用 NEO-unify 架构,只需 8B 小参数就能实现很多商业闭源模型效果。在多测评维度性能领先,还能实现连续性图文创作输出,解决理解与生成断层问题。

机器之心
开源动态8

腾讯混元发布并开源图像模型 2.1,支持原生 2K 生图

9月9日深夜,腾讯发布并开源混元生图模型“混元图像2.1”,支持原生2K高清生图,综合能力领先。它在多方面升级,有诸多亮点,评估显示效果优,还同步开源文本改写模型,能满足多样视觉需求。

InfoQ
产品应用8

GPT-5.1凌晨突袭,奥特曼听劝!全网呼唤的人味回来了

今天,OpenAI GPT-5.1「全家桶」登场,Instant和Thinking同步上线。模型情商智商双核升级,更聪明且聊天有人味。OpenAI还优化自定义ChatGPT语气选项,新功能将逐步开放。

新智元
产品应用7

刚刚,OpenAI开放GPT-4.1偏好优化DPO,ChatGPT能真正学会你的「品味」了!

OpenAI宣布GPT - 4.1全系列模型支持DPO微调,可让AI通过对比回答学会用户偏好。介绍了DPO原理、适用模型、数据格式、创建任务方法等,还提及开发者反应与技术要点。

AGI Hunt
产品应用7

“客户测950,不到一周下单了”,DeepSeek V4 逼出昇腾真功夫

昇腾计算业务副总裁张良透露昇腾近期销量好、认可度提高,大量客户基于其做训练。DeepSeek V4 考验昇腾,其超节点产品均支持。昇腾还对芯片体系和软件栈升级,拒绝仿 CUDA,坚持自主构建生态。

AI前线
开源动态8

华人学生立大功!新王Mamba-3直击Transformer死穴,推理效率碾压7倍

新一代开源架构Mamba-3发布,由CMU普林斯顿原班人马打造,15亿参数性能比Transformer高4%,长序列任务端到端延迟仅为其七分之一。它采用新设计哲学,推理优先,有三大核心技术,还能与自注意力层混合提升检索能力。

新智元