「DeepSeek V3.2」共找到 4016 篇相关文章
00后中国女孩0产品创业实现3亿估值:斯坦福数学博士的AI量化野心
00后中国女孩洪乐潼创业一鸣惊人,虽无产品和用户,但目标估值3 - 5亿美元。她是斯坦福华人数学博士,公司Axiom想为量化和对冲基金公司提供解决数学问题的模型能力,获投资人关注。
MiniMax M2.5:230B参数仅激活10B,开源模型首次逼近Claude Sonnet,成本仅十分之一
MiniMax推出新一代开源模型M2.5,官方称其为‘为现实世界生产力设计的开源前沿模型’。性能逼近Claude Opus 4.6,采用混合专家架构,成本低。已在内部大规模部署,定位为‘AI员工’。
ICML 2025 | 长视频理解新SOTA!蚂蚁&人大开源ViLAMP-7B,单卡可处理3小时视频
在视觉语言模型取得突破的当下,长视频理解挑战凸显。蚂蚁和人大团队提出视觉语言大模型ViLAMP,采用‘混合精度’策略,在多基准测试中超越现有方案,单卡可处理3小时视频,为实际应用带来新可能。
把视频变成图文博客:Agent + 豆包 Seed2.0 lite 重做 Karpathy 两年前的工作流
本文以重做 Karpathy 两年前工作流为例,介绍用 Agent + 豆包 Seed2.0 lite 将视频转为图文博客的方法。详述四步流程,指出其局限,还说明该模式可用于竞品直播追踪、在线课堂报告、游戏赛后复盘等场景。
nano-banana已登陆AI studio 和 Gemini ?果真是谷歌的gemini-2.5-flash图像预览版。。
作者分享玩AI视频创作的经历,介绍神秘AI图像生成和编辑模型Nano - Banana,它在LMArena平台出现,被猜测与谷歌新一代图像模型相关,功能出色。还体验了谷歌aistudio更新的gemini - 2.5 - flash - image - preview,认为其不如nano - banana。
黑森林FLUX.2 Klein开源,亚秒级高质量图像生成和编辑,普通电脑就能跑
黑森林实验室发布开源的FLUX.2 Klein模型家族,是紧凑架构,将高质量图像生成与编辑速度压缩至亚秒级,在消费级显卡实现旗舰性能。其统一架构打破生成与编辑壁垒,还与NVIDIA合作优化。
陶哲轩都惊了!o3首战「AI奥数」碾压夺冠,开源军团仅差5分狂追OpenAI
AI界奥数杯重启,OpenAI o3首参赛,算力拉满时以47分夺冠。测评显示在奥数数学推理上,商用和开源AI差距缩小,开源即将追上商用模型。报告完整测试结果已放出。
编程超越 Gemini 3 Pro?GLM-5 性能实测对齐 Opus 4.6,智谱市值突破1700亿港元
临近春节,智谱AI发布最新旗舰大模型GLM-5,其代码和智能体能力表现出色,在多方面逼近Claude Opus 4.5,性能超Gemini 3 Pro。该模型已开源,依托国产芯片部署,不过受算力限制,将逐步向用户开放。
Sglang 源码学习笔记(三)- 分布式和并行(以deepseek 为例)(WIP)
文章是 sglang 源码学习笔记,聚焦分布式和并行,以 deepseek 为例。介绍通信域类型,分析 ZMQ 和 torch.dist 通信,阐述 TP、DP、EP 实现,包括初始化、使用等,还涉及不同 Linear 层 TP 及 MoE 不同实现情况。
马斯克Grok的AI男友还在取名,开源版AI女友已经火了,还是3D的
前几天Grok推出‘智能伴侣’功能,马斯克在线征集男性Grok数字伴侣命名。网友Jackywine复刻出3D版开源AI女友‘Bella’,介绍了其工作流、愿景及规划的‘AI原生’演进路径。