GLM-4.1V-9B-Thinking」共找到 3098 篇相关文章

开源动态7

两分钟Claude Code模型换成DeepSeek,立省17倍,缓存后爆省120倍

GitHub开源deepclaude,两分钟可将Claude Code模型换成DeepSeek V4 Pro,开销直降17倍。自带上下文缓存机制,重复对话成本降120倍。支持多后端选项,可丝滑切换,还能打破设备限制远程编程。

AIGC开放社区
新闻资讯7

900亿天津科技巨头,抓紧押注算力

人工智能产业爆发,算力成竞争核心。中科曙光股价乘风而起,但营收下滑、净利润增速放缓,创始人隐退、控股股东减持带来新考验。不过其全产业链布局或打开新空间,1 - 3月已恢复增长。

芯师爷
推荐文章8

自主Agent时代群雄逐鹿,紫东太初何以走出一条中国特色AGI之路?|甲子光年

2026年OpenClaw掀起全民AI热潮,AI进入自主Agent时代。中科紫东太初依托中科院自动化所,以自研紫东太初ScienceClaw从AI4S赛道切入,破行业痛点,走出中国特色AGI发展之路。

甲子光年
算法论文8

“交互式Scaling”:增加Agent与环境交互的深度和频率来提升性能

在AI发展中,商业研究Agent是“黑箱”,开源研究Agent性能有差距。MiroMind团队推出MiroThinker v1.0,提出“交互扩展”提升性能,在多基准测试表现出色,也指出了当前版本的局限。

深度学习自然语言处理
推荐文章8

大型语言模型正在掏空和填满你的钱包

人工智能改变赚钱和花钱方式,生成式AI每年或为全球经济增2.6 - 4.4万亿美元。文章介绍LLM在多领域应用,如客服降成本、内容创作提效率等,企业应积极拥抱技术革命。

AIGC开放社区
开源动态7

DeepSeek最新模型意外泄露~

DeepSeek最新模型DeepSeek-V3-0526疑似泄露,消息源于https://docs.unsloth.ai/basics/deepseek-v3-0526-how-to-run-locally ,其性能媲美GPT - 4.5 / Claude Opus,或成最强开源模型,信息若属实将很快发布。

PaperAgent
新闻资讯7

“Claude Code更新废了”!热议Issue:思考深度下降67%,已无法胜任复杂的工程任务

AMD的Stella Laurenzo分析发现,Claude Code某次更新后思考深度降67%,无法胜任复杂工程任务,行为走样。团队回应redact - thinking是UI改动,2月两项改动或有影响,但网友并不买账。

量子位
算法论文8

2026 AI Memory最新综述:从理论到实战,一文读懂AI记忆的进化全景

2026年北邮百家AI MemoryOS团队联合华为发表《Survey on AI Memory》,涵盖AI记忆理论基础、分类体系、架构、评估方法与前沿趋势,还提出4W分类法,剖析了发展挑战与未来方向。

PaperAgent
新闻资讯7

失去三个联创后,Mira公司危机持续:又有两人要出走

前OpenAI CTO Mira Murati创办的Thinking Machines Lab危机不断,此前三位联创离开,如今又有两位技术骨干将出走,多家媒体称是OpenAI人才突袭,公司内部产品、发展等分歧或是主因。

机器之心
开源动态8

美团又上新模型,8个Thinker齐开工,能顶个诸葛亮?

临近春节,美团 1 月 15 日更新 LongCat - Flash - Thinking - 2601 模型。它有 5600 亿参数,引入重思考模式,智能体能力提升。实测表现佳,适合特定场景,其技术改进独特,还将推出 ZigZag Attention。

机器之心