「中国DeepSeek精英讲师联合会」共找到 1477 篇相关文章
DeepSeek-V3.2被找出bug了:疯狂消耗token,答案还可能出错,研究人员:GRPO老问题没解决
DeepSeek-V3.2虽强且火爆,但被发现存在bug,即浪费token问题。研究者指出这源于GRPO算法的‘隐藏偏见’,虽修正了‘难度偏见’,但‘长度偏见’仍在,官方也承认token效率是挑战。
4.55亿美金!中国具身智能最大单笔融资诞生,高瓴红杉联手押注具身大脑
近日,成立仅一年的它石智航完成4.55亿美金Pre - A轮融资,刷新中国具身智能最高单轮融资纪录。高瓴、红杉等20余家机构投资。其战略重投大脑和人才,大脑AWE 3.0能力突出,还在高难度场景落地领先。
AI全国榜单爆冷,全网吃瓜大狂欢!这家黑马竟靠DeepSeek杀进全国TOP 2
QuestMobile报告显示,夸克月人均使用次数居AI搜索第一,微博智搜凭DeepSeek排第二,腾讯「新闻妹」第三。实测发现,夸克产品力强,微博智搜让信息获取高效,新闻妹有划词提问等功能,AI搜索正重塑格局。
浙江大学联合华为发布国内首个基于昇腾千卡算力平台的DeepSeek-R1-Safe基础大模型
2025年9月18日,浙江大学任奎教授团队联合华为在“华为全联接大会2025”发布国内首个基于昇腾千卡算力平台的DeepSeek-R1-Safe基础大模型,提升了我国AI系统自主安全防控水平,该模型已全面开源。
DeepSeek V3.1 Base突袭上线!击败Claude 4编程爆表,全网在蹲R2和V4
昨晚,DeepSeek官方悄然上线全新V3.1版本,上下文长度拓展到128k,参数685B,支持多种精度格式。其编程能力突出,在Aider测试中霸榜,性能超越Claude Opus 4,还有成本低等优势。
这届MWC真成了中国AI主场,小米直接把AI从对话框里拽出来接管物理世界了
全球AI竞争从技术探索进入应用兑现期,中国凭场景、数据和硬件生态领跑。小米在MWC展示人车家全生态,用顶尖AI能力和10亿级生态让AI走出屏幕,实现空间智能,率先占位全球竞争。
32B 稠密模型推理能力超越 R1?中国秘密 AI 团队发布推理小模型 AM-Thinking-v1
2025年,国内神秘A - M - team在Hugging Face开源32B推理模型AM - Thinking - v1。它在多推理评测中击败DeepSeek - R1,与超大规模模型成绩相当。团队靠后训练方案挖掘32B模型潜力,探索小体量实现大能力路径。
高考数学全卷重赛!一道题难倒所有大模型,新选手Gemini夺冠,豆包DeepSeek并列第二
因网友质疑上次测评不严谨,此次用六款大模型挑战含解答题的全套高考数学题。结果Gemini 2.5 Pro夺冠,Doubao和DeepSeek R1并列第二。解答题是失分重灾区,图像题难倒多模态大模型。
DeepSeek刚解决了AI视觉最后一块拼图:极低成本+精准视觉定位,AI接管电脑已无死角
DeepSeek放出新论文《Thinking with Visual Primitives》,解决多模态大模型中长期被忽视的“说不清位置”问题。提出将空间标记作为“最小思维单元”插入推理链条的方案,在多个任务上达前沿水平,但也存在精度、触发机制和泛化能力等局限。
独家对话前华为天才少年李元庆:首款规模化具身智能产品中国造!多机异构是未来方向
前华为天才少年李元庆加入乐享科技,负责创新业务与技术攻关。他指出世界首个体量化具身智能产品可能在中国出现,多机异构是未来方向,还谈具身智能发展现状、难题及应对策略,分享未来规划与建议。