长上下文模型」共找到 8197 篇相关文章

开源动态8

刚刚,美团开源全模态龙猫模型,和 ChatGPT 大战 100 回合打得难解难分

美团发布开源全模态 MoE 模型 LongCat-Flash-Omni,参数 560B 激活 27B。它有真正全模态能力,采用创新架构和训练范式,基准测试表现亮眼,部分指标超 Gemini-2.5-Flash,引发网友热议。

AGI Hunt
开源动态8

最小模型仅 25MB,老设备无 GPU 也能流畅跑!

开源项目`KittenTTS`是文本转语音模型系列,核心特点是“小身材,大能量”。最小模型约1500万参数,体积25MB以内,无需GPU,靠CPU就能实现高质量语音合成,适合多种设备和场景。

开源先锋
开源动态8

Anthropic祭出大模型“读脑”杀手锏:LLM决策过程全给你扒开看

Anthropic宣布开源电路追踪工具,可追踪LLM神经元,通过生成“归因图谱”揭示模型输出原因。开源了生成图谱的库和交互式前端,并提供demo notebook。可追踪电路、可视化图谱、检验假设。

AI寒武纪
新闻资讯7

17 万模型背后:魔搭联合 AMD 送 1000 小时 GPU 的算盘

魔搭社区联合 AMD 推出「AMD 开发者激励计划」,提供最高 1000 小时 GPU 算力额度。魔搭社区对标 Hugging Face,托管超 17 万个开源模型。此次激励是三方匹配的生意,还释放了硬件去美元化和模型托管社区升级的信号。

AI Reading Hub
推荐文章7

AI Infra 工程师们如何应对大模型流水线里的“暗涌”?

InfoQ《极客有约》X AICon 直播,邀请华为昇腾专家 ZOMI 酱、蚂蚁集团马介悦和 SGLang 尹良升探讨大模型 Infra 工程师实战日常。涉及大模型工程高频问题、版本迭代策略、推理部署优化、开源项目挑战等内容。

InfoQ
新闻资讯7

内部爆料:Alexandr Wang上任第一把火,Meta大模型闭源

据知情人士,Meta新成立的超级智能实验室正讨论重大决策,高层对AI模型是否开源存分歧。Meta曾因性能问题延迟Llama 4版本,现完成Behemoth训练却因不佳延迟发布,还探讨放弃它开发闭源模型

机器之心
算法论文8

揭秘 | 桥梁缺陷检测新突破:模型压缩42%,精度几乎不掉

全国公路桥梁超百万座,传统人工巡检效率低且有安全风险,现有深度学习检测模型体积大、计算量高。研究团队提出LBSD - YOLO网络,通过创新实现轻量化,实验显示模型瘦身但性能不减,有重要应用价值。

机器学习AI算法工程
新闻资讯8

对话智源王仲远:机器人的大小脑可能会“合体”,但不是今天

今年智源大会上,智源研究院推出“悟界”系列大模型,如Emu3、Brainμ、RoboOS2.0、RoboBrain2.0和OpenComplex2。智源研究院王仲远称大模型技术未到尽头,介绍了模型特点及发展趋势,如机器人大小脑融合需时间。

AI前线
推荐文章7

跟上 AI 的节奏:为演进式架构构建上下文存储库

本文探讨AI辅助开发带来的上下文认知断层问题。在开发中,AI前期提效但后期难题凸显,企业面临团队执行和管理层决策层面隐患。可通过融合三大工程规范构建上下文存储库解决,确保开发逻辑可控。

InfoQ
算法论文8

速度提升,能力却暴跌?扩散模型做智能体的残酷真相

南洋理工大学陶大程教授团队联合发布评测报告,揭示扩散语言模型在智能体能力上有系统性缺陷,落后自回归模型。还分析其失败原因,提出评测框架,明确能力边界并给出研究建议。

机器之心