LLM开发」共找到 2458 篇相关文章

新闻资讯7

大量英伟达GPU开始在仓库吃灰

微软CEO纳德拉承认,公司有成堆GPU因缺电、缺空间闲置。如今电力与数据中心建设跟不上AI产业扩张,算力端企业调整策略,网友建议开发低能耗芯片,微软还将向阿联酋投资建设数据中心。

芯师爷
新闻资讯8

刚刚,OpenAI前CTO Mira Murati公司Thinking Machines Lab发文,揭开了大模型不确定性的真相

OpenAI前CTO Mira Murati创立的Thinking Machines Lab推出研究博客Connectionism,首篇文章聚焦LLM推理的非确定性问题。研究发现真正原因是批次不变性缺失,提出实现批次不变内核的方案,实验效果显著。

AGI Hunt
开源动态8

没想到,最Open的开源新模型,来自小红书

向来低调的小红书昨日开源首个自研大模型 dots.llm1,它是中等规模的 MoE 模型,在较小激活量下性能良好。其开源力度堪称行业最大,还介绍了数据处理、训练优化等多方面技术细节。

机器之心
新闻资讯7

刚刚,Manus恢复独立运营

曾被Meta收购的Manus宣布恢复独立运营,为满足数据合规,需删除部分收购后产生的数据。它开发备份和恢复工具,还准备新功能拓展通用AI智能体能力边界。其出道曾即巅峰,后被收购,如今又回归。

量子位
开源动态7

Karpathy用「harness」彻底终结了RAG。

假期时Karpathy提出llm.wiki想法引发关注。它是元框架,定义人类与AI协作管理知识的方式。与RAG不同,它将新材料关键信息编入已有wiki并持续维护。作者用多种数据测试,发现TextIn API解析效果好,还优化处理流程提升质量。

探索AGI
开源动态7

Vibe Coding“血洗”开源,社区吵翻了:封杀菜鸡 AI 开发者?不如给维护者打钱!

多位研究人员在预印本论文中指出,氛围编码或摧毁开源生态,使官网访问量下滑、社区论坛使用量骤减。研究称要维持开源规模需改革维护者报酬方式,同时分析了其对开发效率、开源软件可持续性的影响,社区对此看法不一。

InfoQ
算法论文8

停止迷信“超级Prompt”:要想AI不犯错,你得专门雇人“怼”它

这篇来自Isotopes AI的论文指出,在生成式AI落地中,迷信‘超级Prompt’不可取。对于高风险场景,单体LLM有局限,论文构建‘AI Office’架构,引入‘对手团队’概念,实验使准确率从60%提升到92.1%,但也有成本和局限。

深度学习自然语言处理
推荐文章7

完全相信 AI 代码的 Uncle Bob,坦诚这条路还没走通

在AI代码普及当下,Uncle Bob放弃人工评审代码,搭建管控框架引争议,Grady Booch反对,认为AI无法替代资深工程师。Uncle Bob设强约束体系,虽有成效但自动化架构规划未达理想,还给出开发建议。

AI前线
算法论文8

首次!AI智能体破解「纳什均衡」,大模型学会博弈论|Cell子刊

多所高校研究团队开发出PrimeNash大语言模型智能体框架,能自动推导纳什均衡闭式解析解并生成证明。它模拟人类科研路径,分三模块求解,经经典博弈验证,还在碳市场博弈展现应用潜力。

新智元
开源动态7

MotlBot作者被Claude刁难后:MiniMax M2.1是最优秀的开源模型

Moltbot热度不减,开发者挖掘其实用价值,阿里云、腾讯云上线相关云服务。Moltbot作者Peter接受采访,分享项目起源、开发思路等,认为MiniMax M2.1是优秀开源模型,还探讨了智能体发展及项目后续规划。

量子位