多模态大模型」共找到 9309 篇相关文章

开源动态8

开源!强效果,高性能,严隐私?我全都要:OPPO 终端模型实践

OPPO AI 中心推出开源端侧多模态大模型 AndesVL,含 0.6B - 4B 四档尺寸套件,有通用能力强等优势。它经多阶段训练,OPPO 还构建端侧部署方案,评测显示其在多方面表现优异,未来会继续技术革新。

InfoQ
开源动态8

利用模型从开源情报中自动提取检测规则:LLMCloudHunter,有开源

随着网络攻击增加,威胁情报成主动安全关键。以色列本古里安学发布LLMCloudHunter框架,用模型从开源情报自动生成检测规则,评估显示其规则质量高,且部分能编译成Splunk查询,软件已开源。

AI与安全
算法论文8

团队发布首篇语言模型心理测量学系统综述:评估、验证、增强

随着语言模型(LLM)能力迭代,传统评估方法难满足需求。北宋国杰教授团队论文首次系统梳理LLM心理测量学研究进展,革新评估原则,扩展测量构念与方法,还给出增强方法与未来研究方向。

机器之心
产品应用7

DeepSeek接入智慧小浪,「评论罗伯特」爆梗进化!背后模型全揭秘

新浪新闻推出AI辅助工具「智慧小浪」,接入DeepSeek深度思考能力,依托知微模型,能总结资讯要点、提供延伸阅读。微博「评论罗伯特」升级,更懂用户情绪、回复有深度。此外,微博还有博主AI助手等爆款应用。

新智元
算法论文8

揭开模型“伪遗忘”,港理工等团队:结构不变就是没忘

近年来语言模型隐私风险受关注,机器遗忘技术应运而生。港理工等团队构建表示空间诊断工具,区分‘可逆性遗忘’与‘不可逆遗忘’,揭示遗忘现象背后表示结构变化规律,还做了相关实验并得出核心结论。

量子位
开源动态8

微软、哈佛开源创新优化器:全面超越Muon,提升模型训练效率

随着模型训练所需计算资源爆炸式增长,微软和哈佛团队联合开源优化器Dion。它利用低秩近似和解耦动量缓冲区,避免分布式训练同步完整梯度,在集中式和分布式场景都有高效表现,性能超Muon。

AIGC开放社区
推荐文章8

百度端侧模型安全建设实践:在算力与保障之间找到平衡

在 QCon 全球软件开发会上,百度李志伟分享端侧模型安全建设实践。介绍其发展趋势、优势与应用场景,指出面临隐私、内容等安全挑战,阐述云端与端侧安全方案,通过案例展示优化效果,展望未来安全建设方向。

InfoQ
新闻资讯7

全国首部AI模型私有化部署标准,公开征集起草单位和个人!

近期AI领域政策频出,企业对人工智能应用需求攀升,倾向私有化部署,但面临诸多问题。由智合标准中心组织起草的《人工智能模型私有化部署技术实施与评价指南》团体标准立项,现征集起草单位和个人。

AI进修生
算法论文8

均值至上假繁荣!北新作专挑难题,逼出AI模型真本事

当强化学习成模型后训练核心工具,主流方法陷入「均值优化陷阱」,推理能力停滞。北团队提出RiskPO,将风险规避理念融入优化目标,用MVaR+捆绑策略双管齐下,三任务表现优异。

新智元
产品应用8

全球首个通用决策模型,AI推演现实世界的技术揭秘

中科闻歌决策机Decitron被称为「全球首个通用决策模型」,它将不同能力统一到开放世界决策框架,形成闭环。8月3日其技术报告发布,公开三项核心技术,还介绍了推演流程和实验验证情况。

机器之心