超体」共找到 3445 篇相关文章

新闻资讯8

763亿港元,大模型公司最大规模IPO!MiniMax登陆港交所,开盘前大涨50%

MiniMax正式在港交所主板挂牌上市,股票代码“00100”。此次全球发售约3358万股,募资约55.4亿港元。市场认购热烈,早盘一度涨幅50%,市值突破763亿港元。其技术多模态齐发,组织高效,为行业提供新样本。

量子位
算法论文8

Nature Computational Science | 香港城市大学韦业等:复杂系统深度主动优化

本文通过集成深度神经网络和树探索能力,提出神经网络代理模型引导树探索的主动优化方法。该方法在2000维数值优化问题中找到全局最优,在多领域表现优于现有方法,为小样本、高维优化难题提供通用技术。

力学与人工智能
算法论文8

极简RL新范式:一半算力刷新1.5B模型推理SOTA

过去为提升中小参数量模型推理能力,开发者构建复杂RL流水线。JustRL论文提出极简、单阶段、固定参训练方案,在两主流1.5B模型上刷新SOTA,节省2倍算力,消融实验还揭示部分技巧会致性能退化。

深度学习自然语言处理
新闻资讯8

奥特曼回应一切:重组后仍需微软支持,不相信OpenAI的欢迎做空

近期 OpenAI 完成资本重组,与微软合作迎来新篇章。奥特曼和微软 CEO 纳德拉在播客中深入讨论投资结构、产品分销等未来战略,还澄清外界关注的核心问题,如算力瓶颈、财务健康质疑等。

机器之心
产品应用7

老黄亲自站台,英伟达编程神器!Cursor 2.0自研模型狂飙4倍

Cursor 2.0版本重大升级,发布自研编码模型Composer,速度是同等模型4倍。还重构IDE交互逻辑,支持多智能模式,引入语音模式等。早期测试和开发者反馈其速度快,但智能程度与部分模型有差距。

新智元
新闻资讯7

焦虑的贝索斯,决定先裁30000人

亚马逊启动史上最大裁员,先裁14000人,明年或再裁。表面因疫情后人员冗余,实则源于AI军备竞赛压力,AWS优势缩小。公司还计划用机器人替代50万员工,中层和初级岗位受冲击大,H - 1B员工处境艰难。

新智元
算法论文8

AI在线强化学习“边做边学”,斯坦福团队让7B小模型性能飙升,甚至越GPT-4o

斯坦福等团队提出新范式AgentFlow,由四个智能组成,用在线强化学习持续提升智能系统推理能力。以Qwen - 2.5 - 7B - Instruct为基座模型的它在多基准测试表现突出,甚至越GPT - 4o等大模型。

量子位
开源动态8

1万亿参数Ling-1T开源,国产LLM牛了~

Ling-1T是Ling 2.0系列首款旗舰“非思维”模型,总参数量达1万亿。预训练数据20万亿token,支持128K上下文长度。在多项任务中表现出色,是目前已知最大的FP8训练基座模型,已完成全面评测。

PaperAgent
开源动态7

详解Github 35K+项目:打通200+数据源,构建企业级AI的数据统一入口,支持MCP【下篇】

本文继续介绍MindsDB这款开源AI数据引擎,阐述知识库与混合检索应用,如创建向量索引、语义检索、多源混合检索等;还提及RAG与数据智能,包括构建RAG管道和配置Data Agent;最后给出应用建议,称其适合复杂企业环境。

AI大模型应用实践
新闻资讯7

18岁天才少年,登上Nature封面!

DeepSeek-R1荣登Nature封面,成史上首个经严格同行评议大模型。18岁天才少年涂津豪以实习生身份参与,其从高中生到Nature作者的经历堪称传奇。他还改造Claude 3.5,开源项目获15k多星,还对AGI发表思考。

新智元