大模型开源」共找到 10086 篇相关文章

产品应用7

模型是万能的吗?探索机器学习+⼤模型在某出海投资业务的应⽤

本文基于公共云客户出海投资业务案例,探讨用AI模型结合机器学习算法构建投资预算预测与分配系统。历经三版方案迭代,从纯模型到引入机器学习算法,目前项目处于落地阶段,有望实现多方共赢。

阿里云开发者
开源动态8

美团智能体SOTA模型LongCat-Flash-Thinking-2601开源

美团龙猫团队开源智能体推理模型LongCat - Flash - Thinking - 2601,总参数5600亿。该模型在多方面有卓越表现,团队通过构建数据、模拟环境、采用强化学习策略及设计高效架构等,使其比肩闭源模型

AIGC开放社区
算法论文7

ACL 2025 | 语言模型正在偷改你的代码?

本文聚焦语言模型在代码推荐中的「供应商偏见」,通过分析7个主流模型在30个场景的59万次响应,发现模型会偏好特定供应商,甚至擅自修改代码,还探讨了风险、局限并给出展望。

机器之心
新闻资讯8

火山引擎发布豆包模型1.6,加速Agent规模应用

6月11日,火山引擎举办Force原动力会,发布豆包模型1.6、视频生成模型Seedance 1.0 pro等,升级Agent开发平台。豆包1.6表现优异,应用广泛;Seedance 1.0 pro评测领先。还通过创新定价等推动Agent规模化应用。

AIGC开放社区
开源动态8

5B参数+4060Ti,10秒出图,全流程开源可复现!补齐统一多模态生成编辑的开源版图,让高质量图像生成真正变得更轻量、更普及

近日,多机构联合发布统一多模态生成编辑模型DeepGen 1.0,仅5B参数,集成五能力,4060ti 16G上10秒出图,多项指标超4倍工业级模型。团队开源全流程代码与数据,可从零复现。

量子位
算法论文8

伦理防线不可靠!分布偏移诱导,模型进入暗黑模式

香港理工学与西北工业学联合研究指出,当前语言模型对齐机制仅实现表层合规,预训练时内化的有害知识仍潜藏。遇数据分布偏移,模型“黑暗模式”易被激活。26个主流模型中22个在攻击下失效,凸显现有范式缺陷。

新智元
新闻资讯7

闹玩呢!首届模型对抗赛,DeepSeek、Kimi第一轮被淘汰了

谷歌发起首届模型国际象棋对抗赛,为期三天。参赛模型众多,首轮中 Gemini 2.5 Pro、o4 - mini、Grok 4 和 o3 以 4 - 0 战绩晋级半决赛,DeepSeek、Kimi 首轮被淘汰,目前 Grok 4 是夺冠热门。

机器之心
新闻资讯7

扎克伯格发文正式告别“默认开源”!网友:只剩中国 DeepSeek、通义和 Mistral 还在撑场面

Meta 首席执行官扎克伯格分享“个人超级智能”愿景,透露公司调整 AI 模型发布策略。此前 Meta 强调开源优势,如今态度转变,巨额投入后或暂停开源模型,计划并行训练开源与闭源模型

AI前线
新闻资讯7

忘掉模型,微软实证:小模型才是Agentic AI的未来!

过去两年模型在数学竞赛题上靠Test - Time Scaling发展遇天花板。微软rStar2 - Agent让14B小模型学会‘写代码→跑结果→改思路’,表现出色。还介绍了其基础设施、算法、训练配方等方法。

PaperAgent
开源动态8

NVIDIA 开源 Live VLM WebUI:摄像头实时测试视觉语言模型

NVIDIA 开源 Live VLM WebUI,可让用户在本地用摄像头实时测试视觉语言模型。它基于 WebRTC 技术,能将摄像头视频流实时传输给模型,分析结果叠加在画面上,支持多后端、多平台及多种模型

AI工程化