「MiMo V2 Pro」共找到 924 篇相关文章
ESLint v10 发布,但有开发者已经在考虑换 Biome 了
广泛使用的代码检查工具 ESLint 发布 v10 版本,完成架构调整,移除旧版配置系统,改进查找配置文件方式等。但生态兼容性有问题,迁移成本高,部分开发者考虑换用 Biome 等替代工具。
SeePhys Pro:重新审视多模态物理推理中的视觉理解与训练收益
来自中山大学等的研究者提出SeePhys Pro,是面向多模态物理推理的细粒度评测与训练诊断框架。发布了benchmark、训练集等,测评显示当前模型在信息模态转变时不稳定,为模型评测和训练研究提供基础。
天塌了,Pro用户用不了Claude Code,除非100美元买Max
Anthropic 悄悄修改价格页面,将 Claude Code 从 20 美元 Pro 套餐剔除,变为 100 美元 Max 套餐专属。开发者反应激烈,官方称是针对 2% 新用户的定价测试,OpenAI 借机拉踩,网友质疑,开发者开始物色下家。
DeepSeek低价风暴打服硅谷!海外平台争相倒贴V4 Flash
DeepSeek V4 Flash掀起价格风暴,全球开发者为之疯狂。海外平台如Nous Portal、Cline等纷纷补贴,其能力大幅提升,价格却极低,让开发者更愿尝试开源模型,AI应用层或迎转机,且DeepSeek Code可能将至。
DeepSeek不惜代价保住它!V4关键特性被挖出来了
DeepSeek V4技术报告被深挖,为保留核心设计「batch invariance」不惜代价。该设计能保证线上推理稳定、各环节对齐,是复杂上下文系统底座,但会牺牲GPU利用率等,换来训练等多阶段可复现和稳定度。
刚刚,H20重返中国!老黄亲自斡旋,还有特供版RTX PRO
英伟达官宣恢复向中国销售H20,并推出全新NVIDIA RTX PRO GPU。此前H20因贸易限制被禁售,此次解禁或是老黄来华大礼。不过H20已属‘上个时代产物’,且有新‘继任者’B30。
性能比肩Gemini 3 Pro!昨晚,阿里千问最强模型来了
1月26日深夜,阿里千问旗舰推理模型Qwen3 - Max - Thinking上线,综合性能对标GPT - 5.2与Gemini 3 Pro。它突破传统推理方式,有自适应工具调用能力,助其在企业级AI竞争中领先。
谷歌创始人布林紧急接管Gemini团队,但“3.5 Pro已被取消”
谷歌Gemini 3.5 Pro未按计划推出,据判断已被取消。Gemini Flash系列表现不佳,谷歌AI面临压力,创始人布林重新参与相关战略讨论,而谷歌可能存在算力分配问题。
jina-reranker-v3刷新全球重排榜,效率狂飙4.79%
jina-reranker-v3作为LLM时代向量模型,提出“最后但不晚”交互机制,解决文档检索效率与效果权衡、多语言文档重排性能与效率平衡、模型泛化能力和适应性等问题,架构与训练方案有创新。
DeepSeek-V3.2正式版发布,将开源模型的能力推向极致
DeepSeek-V3.2正式版开源,包含标准版和Special版。它采用稀疏注意力机制,降低计算复杂度。后训练阶段有多项算法改进,支撑高难度推理。还融合思考与工具使用,合成训练数据,在智能体评测表现优异。