「DeepSeek AI」共找到 9969 篇相关文章
浙大打造全球最大类脑计算机,拥有20亿个神经元,接近猕猴大脑规模,能运行DeepSeek
浙江大学脑机智能全国重点实验室发布全球规模最大类脑计算机“Darwin Monkey(悟空)”,用Darwin 3芯片构建,有超20亿脉冲神经元与1000亿突触连接,逼近猕猴大脑规模,能运行DeepSeek等应用。
超强开源模型Qwen3、DeepSeek-V3.1,都被云计算一哥「收」了
亚马逊云科技两大AI平台支持多款新模型,Qwen3和DeepSeek-V3.1已上线Amazon Bedrock。其坚持“Choice Matters”战略,为用户提供多样选择,保障数据安全,还可基于开源模型定制开发。
全球首个科研LLM竞技场上线!23款顶尖模型火拼:o3夺冠,DeepSeek第四
Ai2耶鲁NYU联合推出科研版「Chatbot Arena」——SciArena,23款顶尖大模型比拼科研任务,OpenAI o3夺冠,DeepSeek第四。该平台解决通用基准测试在科研场景‘失效’问题,但其自动评估系统猜科研人偏好远未及格。
辛顿警告AI将取代人类工作,杨立昆反对:应该先听这5个人怎么说
最近,“AI教父”辛顿警告AI将取代人类工作,指出AI与以往技术不同,会突破人类智力瓶颈。但杨立昆反对,建议听五位经济学家观点。这五位学者对AI与人类工作关系看法不一,却都认为这是经济问题。
深度洞察:AI带来的产业发展趋势
文章指出AI正以极快速度改变世界,趋势已成。探讨软件业从以应用为中心到以模型为中心的变革,还将阐述从以应用为入口到以AI为入口、AI巨头发展方向及未来展望等内容。
租了8张H100,他成功复现了DeepSeek的mHC,结果比官方报告更炸裂
元旦期间,DeepSeek发布的mHC震撼AI社区。FlowMode工程师Taylor Kolasinski租8张H100复现mHC,结果比官方报告更优。文章介绍复现实验,对比mHC、HC和标准残差结构,揭示超连接在规模化时的不稳定性及mHC的解决办法。
DeepSeek刚提到FP8,英伟达就把FP4精度推向预训练,更快、更便宜
DeepSeek提及针对国产芯片的FP8量化设计,引发对大模型量化策略关注。不久后英伟达发力低精度量化,将NVFP4策略拓展到预训练阶段,其方案能解决核心挑战,实验证明NVFP4在大规模训练中可行。
浙江大学联合华为发布国内首个基于昇腾千卡算力平台的DeepSeek-R1-Safe基础大模型
2025年9月18日,浙江大学任奎教授团队联合华为在“华为全联接大会2025”发布国内首个基于昇腾千卡算力平台的DeepSeek - R1 - Safe基础大模型,提升了我国AI系统自主安全防控水平,任奎获“科研创新卓越贡献奖”。
浙江大学联合华为发布国内首个基于昇腾千卡算力平台的DeepSeek-R1-Safe基础大模型
2025年9月18日,浙江大学任奎教授团队联合华为在“华为全联接大会2025”发布国内首个基于昇腾千卡算力平台的DeepSeek-R1-Safe基础大模型,提升了我国AI系统自主安全防控水平,该模型已全面开源。
Docker 通过 Cagent 提供 AI 代理确定性测试
AI 代理系统普及,工程团队面临测试概率性输出的挑战。Docker 的 Cagent 是一种 AI 代理确定性测试方法,采用 proxy - and - cassette 模型,虽处早期,但揭示了 AI 代理测试的不同方向。