「Veo 3.1」共找到 3395 篇相关文章
IMO题库“过时”了!OpenAI内部模型挑战最新First Proof,做了7天错了一半
谷歌发布Gemini 3 Deep Think爆火后,OpenAI用未发布内部模型,一周内尝试解答10道来自数学家科研现场的真实问题,5道基本正确。这些题取自真实研究,切断模型“背答案”可能,意味着自主推理能力进化。
一个大脑搞定所有模态,百度ERNIE 5.0技术报告公布
模型发布近3个月后,百度ERNIE 5.0技术报告公布。其底座用超级稀疏架构,参数量万亿但推理激活参数不到3%,实现四种模态原生自回归统一,还在路由调度、训练范式等多方面有创新。
比SOTA快9倍,谷歌DeepMind时空重建,把视频变成时空搜索引擎
谷歌DeepMind联合团队发布D4RT时空重建框架,颠覆传统视频转3D方法。它按需提问,像搜索引擎,处理动态视频高效。内部结构分编码、解码两步,速度快,还发明聪明收割机算法,在多项测试中表现优异。
LangChain Memory 太弱?试试用 MemOS 构建 Agent 专属的“记忆图谱”。
文章聚焦 MemOS 开源框架,深入体验其记忆“图谱”能力,探讨将它集成到基于 LangChain1.x 框架构建的智能体的方法。介绍了基于记忆“图谱”构建 ChatBot、体验记忆“图谱”自动重组,以及集成到 LangChain 智能体等内容。
真·开外挂!MIT新研究:架构0改动,让大模型解锁千万级上下文
MIT CSAIL团队提出递归语言模型RLM,不改动模型架构,让GPT - 5、Qwen - 3等模型具备千万级token超长文本处理能力。它将上下文处理“外包”,实验显示其处理规模超前沿模型,复杂任务优势显著,多数场景性价比高。
刚刚,智谱和华为搞波大的:中国首个国产芯片训练出的SOTA多模态模型!
智谱与华为合作开源新一代图像生成模型GLM-Image,是中国首个全程用国产芯片训练的SOTA多模态模型,擅长文字渲染,拿下多项榜单第一,API调用一张图只要0.1元,还解析了其技术架构。
DeepSeek深夜炸场,开源了一个新项目&论文,V4打前站?
凌晨,DeepSeek开源新项目Engram并公开论文。Engram用可扩展的O(1) N - gram记忆替Transformer早期层节省算力,在多方面实验表现出色,如推理任务增幅大于知识任务,还分析了其机理和系统效率。
程序员下班一看懵了?白嫖 Gemini / 本地大模型做时间追踪,用这个开源小工具给你一天自动出「git log」
Dayflow 是原生 macOS 开源应用,能以 1 FPS 录屏,用 AI 总结生成时间线,解决传统时间追踪记录不具体问题。它功能丰富,有自动时间线、分心高亮等,还支持多种 AI 模式,数据隐私性好。
大模型开发实战从入门到入坑:动手写一个MCP Server去理解MCP背后的技术原理
文章聚焦MCP协议,介绍其是规范应用向大模型提供上下文的开放协议,能让模型调用接口更简单、实现开发解耦。还深度解析技术原理,手把手教从0到1实现MCP Server,助读者理解背后技术。
赢家诅咒?英伟达暴跌背后的泡沫之辩
11月3日至28日,英伟达股价跌幅近15%,黄仁勋有危机意识。同时谷歌股价涨超13%,Gemini3.0重建投资者信心。行业面临‘Scaling时代终结’论断,围绕英伟达GPU折旧周期有争议,TPU路线现曙光,国产算力加速替代。