大模型开源」共找到 10086 篇相关文章

算法论文8

模型自己写代码、自己进化,GIM和港这篇ACL主会,把量化因子挖掘重做了一遍

香港学和GIM提出CogAlpha框架,将Alpha从‘公式’升级为‘代码’,搭建7层21个智能体探索体系,让模型参与研究流程。在5个数据集上跑赢21个基线方法,还具可解释性。

机器之心
新闻资讯7

讲习班日程公布|第四届全国模型智能生成会(LMG 2025)

第四届全国模型智能生成会(LMG 2025)11月1 - 3日在成都召开,预计超千人参会。11月3日的讲习班邀请四位青年专家,围绕AI基础设施、扩散语言模型等前沿议题,分享技术进展与实战经验。

深度学习自然语言处理
算法论文8

拒绝“熵崩塌”和“熵爆炸”!这项研究让模型学会“精确探索”,推理成绩飙升

2024年以来,模型在推理任务上进展显著,得益于RLVR方法,但面临“熵困境”。研究团队提出选择性熵正则化方法(SIREN),通过三重机制精准调控探索行为,实验证明其能提升模型推理成绩。

量子位
算法论文8

从显式CoT到隐式CoT:复旦让AI告别啰嗦,实现模型高效沉默推理

复旦学等机构团队论文提出SIM - CoT技术,解决隐式思维链推理准确率低、不稳定问题。该技术引入步骤级监督,提升性能、效率和可解释性,在多模型和任务测试中表现出色,让模型高效沉默推理。

AIGC开放社区
算法论文8

迎接范式革命:最新、最全的模型Latent Space综述,NUS、复旦、清华等联合出品

模型核心计算正从显式空间转向潜在空间,现有文献缺乏统一视角。NUS、复旦等机构的综述《The Latent Space》从五视角构建框架,阐述潜在空间基础、演进、机制、能力,指出挑战与未来方向。

机器之心
开源动态8

MiniMax重磅开源M1模型:百万上下文超DeepSeek R1,实现性能与效率双杀

MiniMax正式开源首个推理模型M1,原生支持百万级上下文长度,在推理效率、计算成本和复杂任务能力上有独特表现。其在性能和效率上超越DeepSeek R1等模型,还提出创新强化学习算法。

AI科技大本营
开源动态8

Meta 悄悄开源了两个惊艳的 3D 重建模型,物体重建+人体重建!

前两天AI圈被Gemini 3 Pro刷屏,Meta却悄悄开源了两个“硬核”项目:SAM 3D Objects可从一张照片重建任意物体,SAM 3D Body能从一张照片重建人体网格模型,二者结合可构建完整3D场景,且全部开源、可商用。

开源星探
新闻资讯7

逆天改命!OpenAI 开源模型的安全底裤被 Meta 研究员给扒掉了……

Cornell学兼Meta研究员jack morris成功将OpenAI最新开源的推理专用模型GPT-OSS逆向还原成基础模型,绕过对齐和安全措施,还暴露其训练用量版权材料问题,此成果引发社区激烈讨论。

AGI Hunt
开源动态8

阿里开源QwenLong-L1:首个以强化学习训练的长上下文推理模型

LRMs扩展到长文本场景是挑战,阿里开源QwenLong-L1框架,是首个用强化学习训练用于长文本推理的模型。它含三个核心组件,QwenLong-L1-32B性能领先,与Claude-3.7-Sonnet-Thinking相当。

PaperAgent
开源动态7

DeepSeek R1/V3作者开源轻量级vLLM,1200行代码读懂模型推理技术!

DeepSeek R1/V3作者俞星凯开源轻量级vLLM——Nano - vLLM。它有快速离线推理、代码可读、含优化套件等特性,还给出了RTX 4070等硬件和Qwen3 - 0.6B模型的基准测试配置。

PaperAgent