「技术方案评测」共找到 4027 篇相关文章
腾讯混元A13B用130亿参数达到千亿级效果,Flash Attention作者点赞
腾讯混元A13B模型仅130亿激活参数,却能和千亿级大模型竞争,获Flash Attention作者赞叹。它精准卡位性能与效率‘甜蜜点’,依托高质量预训练和结构化后训练,多方面表现突出且已全面开源。
杨植麟被梁文锋叫醒了!Kimi新模型发布即开源,1T参数全线SOTA
172天后,Kimi推出全新Kimi K2基础大模型回应DeepSeek冲击。它为MoE架构,1T参数,激活参数32B,在多任务上领先,发布即开源,还分享技术细节,实测有亮点也待优化,展现回归之势。
征集全国首部AI大模型私有化部署标准起草单位和个人!
智合标准中心组织起草国内首部AI大模型私有化部署标准《人工智能大模型私有化部署技术实施与评价指南》,已正式立项并征集起草单位和个人。该标准能解决企业部署痛点,有全流程覆盖等亮点。
最低仅需2G显存,谷歌开源端侧模型刷新竞技场纪录,原生支持图像视频
今天凌晨,谷歌官宣Gemma 3n,原生支持多模态。它在大模型竞技场超1300分,是首个超此分数的10B以下模型。其VRAM占用低,最低2GB,已在谷歌AI Studio等可用,还公开了技术细节。
想知道你的LLM API被过度收费了吗?隐藏的Tokens终于可以被审计了
马里兰大学CASE Lab团队研究商业不透明大模型服务(COLS),定义其风险,提出三层审计蓝图。还推出验证框架CoIn,能高效识别token数量膨胀,有可定制性且审计开销低,为构建信任提供技术支撑。
对谈 DeepSeek-Prover 核心作者辛华剑:Multi Agent 天然适合形式化数学 |Best Minds
文章是对 DeepSeek-Prover 核心作者辛华剑的访谈。他认为强化学习是 AGI 关键解法,Multi Agent 适合形式化数学。还探讨了 DeepSeek Prover 进展、数学与 AGI 关系、评测基准等,指出未来有全才模型和自主 Agent 出现。
火山引擎发布豆包大模型1.6,加速Agent大规模应用
6月11日,火山引擎举办Force原动力大会,发布豆包大模型1.6、视频生成模型Seedance 1.0 pro等,升级Agent开发平台。豆包1.6表现优异,应用广泛;Seedance 1.0 pro评测领先。还通过创新定价等推动Agent规模化应用。
奥特曼:温和奇点已降临!AI最终掌控物理世界,2030年人类命运大转折
奥特曼在「温和的奇点」一文中称人类跨越AI发展「事件视界」,进入指数级加速阶段。他预测了未来5年技术时间线,还指出奇点悄然渗透,AI自转飞轮越来越快,人类迈向超级智能时代机遇与挑战并存。
20人团队提前实现DeepSeek构想,AI算力变天?直击大模型算力成本痛点
国内20人玉盘AI团队推出SRDA全新计算架构方案,试图从硬件源头解决当前AI算力核心瓶颈。该架构有诸多创新设计,能应对大模型训推痛点,与DeepSeek构想契合,或成大模型专用架构分水岭。
一文读懂:国产AI芯片与英伟达的差距有多大?
文章围绕国产AI芯片与英伟达的差距展开。从算力性能、生态壁垒、市场现状、技术瓶颈等方面分析差距,指出国产芯片虽在部分场景缩小差距,但高端训练和生态成熟度仍落后3 - 5年,突围需多领域突破。