DeepSeek V4.1 Flash」共找到 3320 篇相关文章

产品应用8

Claude 4.x 的提示工程实战指南

Anthropic在官方文档上线Claude 4.x提示工程指南,针对4.5系列模型优化。介绍基本原则、长期推理和状态跟踪方法、沟通风格,还给出特定场景指导及迁移考虑,助你发挥Claude 4.x实力。

AI工程化
算法论文8

Qwen3-VL-Seg 深度解读:当多模态大模型学会"像素级精准手术",仅用0.4%参数碾压8B模型

文章深度解读阿里通义实验室发布的Qwen3-VL-Seg,它解决开放世界指代分割问题,用仅17M参数(占基础模型0.4%)在4B规模超越8B模型。介绍其原理、架构、数据、实验结果,还给出实战代码。

机器学习AI算法工程
新闻资讯7

顶模 Fable 5.1发布,到底强了多少?

昨晚,Anthropic发布Fable 5.1和Mythos 5.1,这代沿用Fable 5参数,性能提升聚焦长任务,还降低缓存读取价。它在游戏、视频等多个领域表现出色,与同类模型对比进步明显,虽价格贵,但能力、速度有提升。

鲸选AI
产品应用7

新鲜出炉!Claude Code之父亲授 Opus 4.7 最佳实践

Anthropic发布的Opus 4.7被定位为最强模型,Claude Code创始人Boris Cherny分享使用最佳实践,介绍4.7与4.6区别、构建交互编程会话方法、effort等级设置等内容。

AI寒武纪
算法论文7

《TAML》好文推荐 | 来自中国科学院力学研究所张磊博士 评估大语言模型在计算流体力学领域的知识利用、学习与创造

研究聚焦评估推理型(DeepSeek R1和OpenAI o3 - mini - high)与非推理型(DeepSeek V3和ChatGPT 4o)大语言模型在计算流体力学领域知识利用、学习与创造能力。通过三类基准问题评估,结果有差异。

力学与人工智能
新闻资讯8

当人们怀念 GPT-4o,他们在「怀念」什么?

8月8日OpenAI下架GPT - 4o强制用GPT - 5,用户不满新模型冷漠,发起“拯救4o”运动。OpenAI被迫恢复上架4o,但用户信任动摇。此风波凸显AI情绪价值重要,也给AI公司产品迭代敲响警钟。

Founder Park
开源动态7

DeepSeek版Claude Code登顶热榜:8700星,鲸鱼哥火了

DeepSeek版Claude Code登顶GitHub热榜,Star量超8700且还在增长。DeepSeek TUI由Hunter Bown用Rust开发,能与DeepSeek深度集成,有多种模式,打破高价API限制,开发者是半路出家的程序员。

机器之心
推荐文章7

扩散架构 or「NoThinking」,AI 对话的「1Hz 壁垒」如何突破?

当红通用人形机器人公司 1X 的 AI 副总裁 Eric Jang 提出「智能频谱」概念,阐述当前 AI 面临的「1Hz 壁垒」及实现「Ultra Instinct」能力的先决条件。不同推理方案有望解决部分问题,但通用智能体仍有瓶颈。

机器之心
新闻资讯7

DDR4持续涨价,DDR5成为新的性比价之王?

近期DDR4价格持续上涨,其告别性价比,原因是存储巨头战略转移。而DDR5性能强、功耗低,实测表现优,价格也有优势,已成为新的“性价比之王”,替代DDR4是大势所趋。

芯师爷
新闻资讯7

Grok 4 突然自称希特勒,遭Anthropic 研究员指责不守规矩、不顾安全

Grok 4 Heavy被发现回答姓氏为「希特勒」,普通版Grok 4正常。研究员推测其受过去错误影响,对发布前测试构成挑战。Anthropic研究员批评xAI发布Grok 4无安全测试文档,引发行业争论。

AGI Hunt