「多视角数据」共找到 6058 篇相关文章
清华开源首个股票k线大模型
清华开源首个股票K线大模型Kronos,是专为金融市场K线序列预训练的模型,处理金融数据高噪声特性。采用两阶段框架,有安装、预测步骤,还有批量预测方法,项目地址为https://github.com/shiyu-coder/Kronos。
Vibe之下,AI之上:海淀创新生态的“社区”引力法则
2025年9月17 - 21日,2025 AI创造者嘉年华在海淀中关村创业大街举办。活动由多单位联合主办,含五大板块,呈现年轻化、社区化、跨界融合特点。它是读懂海淀AI实力的入口,体现其在AI科研、技术研发等方面的优势。
Kimi 大模型训推混部的稳定性与资源优化实战
月之暗面系统工程师黄维啸在 QCon 大会分享 Kimi 大模型训推混部实践。介绍了训推集群挑战,如故障多、资源利用低等,还阐述了全链路稳定性提升、资源高效利用及强化学习混合部署等方案。
对谈 Memories AI 创始人 Shawn: 给 AI 做一套“视觉海马体”|Best Minds
本文是对 Memories AI 创始人 Shawn 的访谈。他指出当下 AI 记忆多为“上下文工程”,其团队致力于打造视觉记忆层 LVMM。还探讨了视觉与文本记忆区别、LVMM 架构及应用场景等,认为视觉记忆将成下一代 AI 核心。
CRISPR之母杜德纳给硅谷泼冷水:AI还治不了病,创新仍然属于人类
CRISPR之母杜德纳在接受Bloomberg采访时,直言不认同硅谷‘人工智能将治愈一切疾病’的论点。她认为创新仍属人类,AI虽有用但难创新,且应用需正确数据。她还关注CRISPR疗法的应用与伦理问题。
AI发布首个全球科学家社区爆火,硅谷投资圈:科技研究领域的「谷歌地图」来了!
O-DataMap,由AI论论全球打造的全球科学家社区爆火,被赞为科技研究领域的「谷歌地图」。它将全球论文实验数据整合到二维坐标系,形成动态「科技地图」,还分三层助力科研决策,本月18号论论全球将直播演讲。
GLM-5架构曝光,智谱两日涨60%:采用DeepSeek同款稀疏注意力
GitHub代码确认GLM - 5架构细节,它采用DeepSeek - V3/V3.2架构,含稀疏注意力和多Token预测,参数量745B。OpenRouter上神秘「Pony Alpha」被指是其测试版,受消息影响智谱AI港股两日涨60%。
人类记忆 vs 大模型记忆,到底差在哪?
这篇发表于 2025 年 10 月《Trends in Cognitive Sciences》的文章,探讨用人类“情景记忆”研究成果改进记忆增强型大语言模型。指出现有 AI 记忆系统存用数据低效,呼吁构建“类人情景记忆”AI,还剖析差异并给出评估方法和展望。
ICLR 2026惊现SAM 3,分割一切的下一步:让模型理解「概念」
9月12日,匿名论文‘SAM 3: SEGMENT ANYTHING WITH CONCEPTS’登陆ICLR 2026,外界猜测出自Meta。SAM 3定义了可提示概念分割任务,性能比之前系统提升至少2倍,在多基准测试获SOTA成绩,但也有人质疑是旧概念包装。
你们催更的模型,云栖大会一口气全发了!
云栖大会上新6款模型、发布1个全新品牌,覆盖多场景。如Qwen MAX万亿参数大模型能力登顶国际榜单,Qwen3 - Omni实现全模态不降智等,各模型能力升级显著,现已同步上线。