万亿Token工厂」共找到 840 篇相关文章

新闻资讯8

AI圈“集体开大”!DeepSeek、Claude带头,智谱、阿里、蚂蚁、智源都“卷”起来了

双节前最后一天,AI圈“卷”疯了!智谱发布并开源GLM - 4.6,是国内最强Coding模型;阿里介绍视、听、说全模态同传大模型Qwen3 - LiveTranslate - Flash;蚂蚁开源万亿参数推理大模型Ring - 1T - preview;智源开源跨本体基座大模型RoboBrain - X0。

AI科技大本营
开源动态7

这可能是,全球最强开源Agent模型,走了一条反Scaling Law的全新范式!

MiroThinker v1.5开源,其30B小模型在Agent benchmark上击败万亿参数的Kimi K2T。它以交互深度为新Scaling维度,训练有严格时间管控,实测表现超Search Agent,“小模型+强交互”或成新方向。

探索AGI
新闻资讯7

郭台铭,重回首富宝座

曾经放言“给大陆赏饭吃”的郭台铭,因工业富联市值突破万亿,再次被大陆资本市场推上中国台湾首富宝座。工业富联在AI算力基础设施领域表现抢眼,其AI服务器业务成增长主力。郭台铭海外投资受挫后回归内地,推动公司转型。

芯师爷
算法论文8

欲取代transformer的SSA(次平方稀疏注意力)解读

文章解读了欲取代Transformer的SSA(次平方稀疏注意力)算法。它支持12M tokens上下文,比fastAttention快52倍,训练和推理更快。SSA改变了注意力扩展特性,有计算和内存线性扩展等特性,经三阶段训练可可靠利用长上下文。

Agent的潜意识
产品应用8

杀疯了!单卡4090跑通全量微调,面壁1B级多模态性能怪兽硬刚大厂

面壁智能推出MiniCPM-V 4.6,参数约1B,性能和推理效率出色。它在多模态任务综合能力、推理速度上领先竞品,靠ViT架构改造和4倍/16倍混合视觉Token压缩实现创新,有工业验证,对开发者和普通用户意义大。

AI寒武纪
新闻资讯7

小米小爱同学:资源受限下,实现端侧大模型的高性能推理

InfoQ对话小米小爱同学端侧AI负责人杨永杰,了解其团队在资源受限的端侧设备实现大模型高性能推理的策略。目前端侧大模型商业化落地慢,团队提前布局,自研框架,实现超180 tokens/s推理速度,还分享未来突破方向。

InfoQ
新闻资讯8

The Batch: 885 | Claude 升级了

Anthropic更新中型模型Claude Sonnet至4.5版本,在性能上显著提升,还引入可变推理token预算。Claude Code智能编码工具也获功能增强,新增Claude Agent SDK等。测试中Claude Sonnet 4.5表现优异,Anthropic重心转向编码与职场生产力。

DeeplearningAI
新闻资讯7

全民拜龙?我看是大厂“套壳大战”搞疯了

OpenClaw是开源AI Agent框架,引发全民热潮,中国大厂纷纷推出套壳产品。国产套壳产品上手难度低,但也存在问题。傅盛基于此养出AI团队,猎豹移动市值涨24%。不过,OpenClaw存在安全问题,背后是Token入口争夺战。

鲸选AI
新闻资讯7

曝GPT-5.5用上「全球最快芯片」,Claude慌了!

新智元报道,OpenAI的GPT - 5.3 - Codex - Spark用Cerebras的WSE - 3芯片达2000 token/秒。Cerebras CFO称在跑GPT - 5.4和GPT - 5.5,但SemiAnalysis报告指出其跑大模型有短板,且公开云模型小、上下文短。

新智元
产品应用8

不敢信?中国AI国家队出手,刚刚通关了万亿级主战场「地狱副本」

文章指出智能体虽强,但在招标采购等落地场景面临挑战。科大讯飞发布招采智能体平台,提出智能体工厂概念,解决招采痛点。还提炼出四个行业判断,分析其成功原因,标志AI在B端场景走向落地。

新智元