「DeepSeek V4 Pro」共找到 1342 篇相关文章
芯来科技胡振波:将RISC-V从兴趣发展为事业,现在公司的IP比人还多
2025年RISC - V中国峰会召开,芯来科技创始人胡振波演讲。他最早接触RISC - V,2018年创立芯来科技。公司专注IP领域,已跻身第一梯队,产品全。胡振波分析IP商业模式要素,介绍各领域应用,还对行业发展提出展望。
英伟达震撼首测Vera Rubin,DeepSeek吞吐暴涨30倍!
英伟达公布下一代旗舰级机柜Vera Rubin NVL72片上实测数据,用DeepSeek - V4 - Pro跑任务,每兆瓦吞吐量最高升30倍、Token成本最高降35倍。还宣布Groq 3 LPX量产,推出Agent专属Vera CPU,被SpaceXAI采用。
自写驱动越狱!Gemini 3 Pro零败绩通关宝可梦:效率碾压前代8倍「Agent进化太快了」
在全自动《宝可梦 水晶版》对决中,Gemini 3 Pro击败Gemini 2.5 Pro,通关速度至少快2倍,前代或慢8倍。它还展现出诸多能力,如自写驱动绕过限制等,但也存在不验证假设等局限。
DeepSeek-OCR是「长文本理解」未来方向吗?中科院新基准给出答案
DeepSeek-OCR的视觉文本压缩技术降低长文本处理成本,中科院自动化所等团队推出VTCBench基准测试评估模型视觉认知,含三大任务及衍生版本,测试结果有‘U型曲线’,还评测多种尖端模型。
DeepSeek-OCR是「长文本理解」未来方向?中科院新基准VTCBench给出答案
DeepSeek - OCR的VTC技术可实现高压缩率,降低长文本处理成本。但视觉语言模型能否理解压缩信息存疑,中科院等推出VTCBench评估,测试模型认知极限,还推出VTCBench - Wild检测鲁棒性。
国外网友疯传DeepSeek R2/R3/R4 炸裂突破,超越传统的「跨因果超矩阵」,并在训练过程中自发产生了R5……
国外网友疯传DeepSeek R2到R5的“重磅”消息,爆料内容层层递进且玄幻离谱。Anthropic联合创始人评价有认可也有轻视。当下闭源模型各领风骚,开源阵营期望集中在DeepSeek R2,应平常心看待传言。
AI生成视频总不符合物理规律?匹兹堡大学团队新作PhyT2V:不重训练模型也能让物理真实度狂飙2.3倍!
匹兹堡大学团队提出 PhyT2V 框架,论文已被 CVPR 2025 接收。该框架不依赖重训练或大量外部数据,通过链式推理与迭代修正机制,增强主流 T2V 模型物理场景泛化与生成能力,应用前景广。
个人开发者训400亿参数大模型:分布式算力,DeepSeek架构,3090单卡部署
Nous Research推出Psyche Network,可整合全球算力训练AI。它基于Deepseek的V3 MLA架构,有DisTrO优化器等技术,能让个人和小团体创建大规模模型,还实现40B参数LLM预训练。
DeepSeek流量暴跌?AI大模型全球霸主离奇遇冷,外媒曝出真相
曾以低价高性能出圈的DeepSeek,在自家平台遇冷、市场份额下滑,但其R1和V3模型在第三方平台使用量增长近20倍。背后是‘Token经济学’及战略转移,它开源模型,将算力留作研发。Anthropic也因算力受限有类似问题。
清库存!DeepSeek突然补全R1技术报告,训练路径首次详细公开
DeepSeek给近一年前登上《Nature》封面的R1论文补64页技术细节,正文大幅翻修。新论文展开R1完整训练路径,补充R1 - Zero分析,还披露安全评估细节。此外团队稳定,引发对其后续动作猜测。