DeepSeek V4 Pro」共找到 1342 篇相关文章

算法论文8

0.01%参数就能接近全量微调!低数据微调极致省参方案来了 | ACL'26

瑞典隆德大学与Google DeepMind团队研究大模型微调省参方案。发现低数据场景下,微调Value投影中的b(v)比b(q)或b(k)性能更好。该研究已被ACL 2026接收,集成进Hugging Face - PEFT库。

量子位
产品应用7

慕思联手华为鸿蒙,完成一场卧室里的“静默实验”|甲子光年

在AI浪潮下,睡眠场景需“静默革命”。慕思联手华为鸿蒙推出鸿蒙智选慕思智能床Pro H - Design,采用底层代码级深度共研,还自研传感技术与算法,构建闭环服务用户,重写智能床竞争逻辑。

甲子光年
新闻资讯8

3晚攻克世界数学难题,黑洞方程秒解!OpenAI:AI正让科学加速100年

2026年,AI成科学家新战友。数学家Ryu用ChatGPT三晚攻克优化难题;物理学者Lupsasca用GPT - 5 Pro 18分钟重现黑洞隐藏对称性;OpenAI为生物领域构建GPT - 4B Micro助力攻克难题。OpenAI称科学加速时代来临。

新智元
产品应用8

看完最新国产AI写的公众号文章,我慌了!

AI 快砸作者饭碗,智谱 GLM - 4.6V 能根据 NeurIPS 2025 最佳论文生成图文并茂的公众号文章。它还能助力学生看论文、分析财报等,可复刻网站、处理视频,在多模态评测中达同级别 SOTA。

量子位
开源动态8

HAMi × NVIDIA:GPU 拓扑感知调度实现详解

HAMi社区在v2.7.0版本推出针对NVIDIA GPU的拓扑感知调度功能,解决多卡通信瓶颈。文章深入剖析其设计与实现原理,介绍核心特性、阶段及代码,用双策略寻优算法保障性能与资源健康。

AI前线
开源动态8

是「福尔摩斯」,也是「列文虎克」,智谱把OpenAI藏着掖着的视觉推理能力开源了

智谱开源视觉推理模型 GLM-4.5V,还同步开源桌面助手应用。此模型视觉推理能力强,在图像识别、视频理解、前端复刻、图表处理等多方面表现出色,技术创新使其达开源 SOTA 水平,推动行业注重实用价值。

机器之心
产品应用8

比「小龙虾」更能打,中国AI视频大模型悄悄登顶全球第一

昆仑万维旗下 SkyReels-V4 Preview 版在权威评测平台超越 OpenAI、Google 等模型,登顶全球第一。它提升语义理解和逻辑能力,新增参考任务,还支持多语言短剧生成、视频编辑等,将在中关村论坛亮相。

机器之心
开源动态8

给GUI Agent装上「世界模型」:阿里通义用混合数据+统一思维链,让模型学会预判屏幕变化

伴随多模态大模型发展,GUI Agent成人机交互新范式,但构建高可用、跨平台的GUI Agent面临诸多挑战。阿里通义实验室开源Mobile - Agent - v3.5框架及GUI - Owl - 1.5模型家族,解决了相关技术壁垒。

量子位
新闻资讯7

GPT-5仅23.3%,全球AI集体挂科!地狱级编程考试,夺金神话破灭

最新基准测试SWE-Bench Pro评估AI编程智能体,直面真实企业级工程任务。顶尖模型几乎溃败,GPT - 5仅23.3%。该测试解决现有基准数据污染、任务简单问题,能成未来LLM编码能力标尺。

新智元
新闻资讯7

大模型热度退潮,真正的技术创新者开始被「看见」

过去两年中国大模型投资多是商业模式驱动,而技术投资注重创新。DeepSeek 出圈后,独立创新成主流。今年国内大模型吸金热度下降,但智谱 AI、面壁智能仍获融资。面壁智能发布 MiniCPM 4.0,在多方面优化,展现端侧优势。

AI科技评论