「超参数科技」共找到 3369 篇相关文章
最强开源Agent!Kimi K2接入Claude Code,爽翻~【喂饭级教程+实测】
上周五Kimi开源最新旗舰模型K2,它是1000B参数MoE大模型,专为Agent场景优化,API已上线且兼容多API。文章给出Kimi - K2接入Claude Code的喂饭级教程及实测,实测显示组合表现有亮点也有不足。
vivo发布端侧多模态模型,只有3B可理解GUI界面,20项评测表现亮眼
vivo AI Lab发布端侧多模态模型BlueLM - 2.5 - 3B,融合文本与图文能力,支持长短思考模式切换。它在20余项评测中表现出色,参数量小,训练和推理成本低,有精巧结构、高效策略,还有高质量数据和高性能平台支撑。
当前的上下文方案,本质是暴力破解!DeepMind 创始人:忽强忽弱的 AI,才是真正的灾难,突破在记忆系统
在播客《20VC》中,谷歌 DeepMind 创始人德米斯·哈萨比斯与主持人探讨 AI 未来。他认为 AGI 五年内大概率实现,规模和速度超工业革命;算力是瓶颈,软件记忆系统等突破也重要;还谈及开源、监管、能源等问题。
AI把PC天花板打破了
IDC数据显示2025年第三季度全球PC出货量增长。联想2025/26财年第二财季财报亮眼,PC市占率首超25%,AI业务收入占比达30%。联想在多方面布局,对AI和AI PC潜力有信心。
Qwen3-Next全新架构,32K场景MTP吞吐提升10倍
随着模型大小和上下文长度增加,为应对成本和部署挑战,Qwen3 - Next有突破性架构创新,解决上下文长度和总参数缩放问题。它采用混合注意力、超稀疏MoE等,MTP机制让其长上下文推理吞吐量比前身高10倍以上。
腾讯混元开源 4 个小尺寸模型,主打 Agent 和长文
8月4日,腾讯混元开源四款小尺寸模型,参数为0.5B、1.8B、4B、7B,消费级显卡可运行,适用于低功耗场景。模型具备推理快、性价比高特点,亮点是Agent和长文能力,已在腾讯多业务应用。
万亿思考模型新速度!蚂蚁开源Ring-2.5-1T:IMO金牌水平,强;混合线性架构,快!
蚂蚁集团发布全球首个开源混合线性架构万亿参数模型Ring - 2.5 - 1T,打破深度思考牺牲推理速度和显存的‘不可能三角’。还同期发布扩散语言模型LLaDA2.1和全模态大模型Ming - flash - omni - 2.0,想做成可复用底座。
公众号正在头条化
2025年超60%公众号运营者发现,粉丝被算法收归平台。从2020年起,订阅号改成信息流展示,推荐流量占比最高达90%。这对小号是机遇,但也带来内容陷阱等问题,还重塑用户认知,平台也面临商业和生态的博弈。
机器人整机是“有限游戏”?对话星海图创始人:具身智能商业化的三个阶段,终点是卖Token
星海图CEO高继扬等提出具身智能三重跃迁,发布新模型并开源,首秀自研机器人。公司从整机起步,联合建数据公司,规划数据量。其商业模式分三阶段,认为中国具身基础模型能力有望超美。
1盒内存条堪比上海1套房?内存涨价凶猛,业内人士:有钱的,上亿资金囤货
2025年7月以来,全球DRAM市场经历“史上最强”涨价周期,多数品类涨幅超100%。因产能吃紧、涨价预期等因素,囤货行为从下游扩散到大型贸易商等。本轮价格回升非因消费电子复苏,供需矛盾难缓解,市场现“恐慌性采购”。