模型行为团队」共找到 9243 篇相关文章

开源动态8

Lumina-DiMOO:多模态扩散语言模型重塑图像生成与理解

上海人工智能实验室推出多模态扩散语言模型 Lumina - DiMOO,它基于离散扩散建模,打破多模态任务壁垒。相比传统自回归架构模型,它解决了生成慢、质量受限等问题,在多项评测中夺魁。

机器之心
算法论文8

多模态推理新范式:上海AI Lab新作证明“画”出答案比“说”出答案更靠谱

上海人工智能实验室等联合提出DiffThinker模型,利用扩散模型构建全新视觉推理范式。它在视觉中心任务上表现优异,准确率碾压GPT - 5等模型,还能与MLLM协同推理实现1 + 1 > 2的效果。

深度学习自然语言处理
开源动态8

世界模型一口气输出小时级视频不跑偏,开源了

Alaya Lab等联合推出的Alaya - EVOKE能生成小时级视频,解决常见问题。它把记忆搬到模型外,改造教师模型,经多轮技术操作,实验成绩佳,给出清晰训练方案,也指出项目边界。

量子位
推荐文章7

模型评估排障指南 | 关于 LaTeX 公式解析

这是大模型评估排障指南系列第二篇,聚焦 LaTeX 公式解析。评估难点是解析和比较模型输出与标准答案,无标准方法。lm - evaluation 框架用 sympy 解析准确率约 0.94,还给出缓解问题办法。

Hugging Face
产品应用8

Anthropic 那个“强到不敢发”的模型,终于来了!

今天凌晨,Anthropic 发布新模型 Claude Mythos Preview,它曾被指‘强到不敢发’。该模型能力跃升,尤其网络攻防能力突出,但因具‘双重用途’仅向少数伙伴开放,用于防御性网络安全项目。

InfoQ
新闻资讯8

All In AI的Google I/O 2025还开源了一系列模型,冲~

谷歌CEO称Google IO 2025上,数十年AI研究成果已成为现实。大会亮点多与AI相关,如Gemini 2.5系列模型表现出色,还有Veo 3等。此外,还开源了medgemma、gemma - 3n等模型

PaperAgent
推荐文章8

技术教科书:顶级开发团队设计的Harness工程项目源码什么样

本文深入剖析某顶级AI Agent研究团队的工业级Harness项目源码,涵盖项目全景、启动流程、工具系统等多方面,提炼构建顶级Harness工程方法论,还介绍隐藏彩蛋,展示团队技术实力与独特魅力。

腾讯技术工程
开源动态8

南洋理工、北大、上海AI实验室开源长记忆世界模型

目前世界模型模拟方法在维持长期一致性上有挑战,南洋理工大学、北京大学王选计算机技术研究所、上海人工智能实验室联合开源长记忆世界模型WORLDMEM,介绍了其记忆机制、基础架构、训练技术及检索策略等。

AIGC开放社区
新闻资讯7

刚刚,Meta 超级智能团队44名成员信息曝光,半数来自中国

风投公司投资人晒出匿名Meta员工盘点的超级智能团队44名成员信息,半数来自中国,成员学历、履历等情况明晰,但有人质疑名单真实性和全面性,团队阵容或更庞大。

机器之心
推荐文章7

模型的第一性原理:(二)信号处理篇

本文从信号处理角度解读大模型原论文,探讨语义向量化原理,分析 Transformer 与 Granger 因果关系。指出大模型输入 Token 语义嵌入是将自然语言处理转化为信号处理问题,向量化与信号处理、信息论联系紧密。

机器之心