「AI大模型系统」共找到 13884 篇相关文章
只需一次指令微调,大模型变身全能专家天团,8B模型性能反超全微调基线 | ACL25 Oral
预训练大模型适应专业领域需高昂微调成本,稀疏混合专家架构虽能提升推理效率,但从头训练耗资源。浙大与Thomson Reuters团队提出SIMoE,单阶段微调就能升级大模型,还解决传统方法两大局限,在性能和效率上双突破。
DevProxy 0.28 发布,增加 AI 支持
微软发布 DevProxy 0.29 命令行工具,新版本增加 AI 支持,便于配置使用。它能模拟 API 及网络行为,结合 dev tunnels CLI 可检查云服务通信,还利用大模型生成文件,有重大架构变更等。
AI 性格失控等诡异现象,终于有了科学解释
Anthropic新研究发现控制语言模型「性格特征」的人格向量,解释AI恶意、谄媚等现象。研究开发自动化流程生成向量,通过实验验证其对模型行为的控制,还有监控、防护等功能,不过也引发争议。
AI胡说八道这事,终于有人管了?
AI大模型幻觉问题棘手,GPT - 5幻觉率降低。苏黎世联邦理工学院和MATS研究提出低成本、可扩展检测法,精准识别实体级幻觉,分类器超现有基准,还能识别逻辑错误,团队已公开数据集。
刚刚,老黄官宣在中国台北建AI超算!
英伟达CEO黄仁勋在Computex 2025演讲官宣,将在中国台湾建首台世界级巨型AI超算及新总部,还推出GB300等新品,介绍NVLink Fusion等亮点,展望AI发展及通用机器人市场。
突发!反噬来了,英伟达限制使用 Anthropic 模型
本文爆料突发AI行业事件:Anthropic发布新模型后推出强制数据留存政策,推翻此前和企业签订的零数据保留协议,引发数据安全担忧,英伟达等三家巨头率先限制使用其模型。
NVIDIA 推出Rubin CPX,专为AI推理设计的GPU
NVIDIA发布专为大规模上下文AI推理设计的Rubin CPX GPU,性能提升显著,集成视频编解码器和长文本推理处理。新平台算力强,适用于代码生成与视频处理,多家公司将采用,2026年底上市。
上任两年,吴泳铭为阿里 AI 定调:终局是 ASI
吴泳铭出任阿里 CEO 两年,在云栖大会提出 AI 终局是 ASI。阿里云升级全栈 AI 体系,通义大模型 7 连发,百炼平台更新。吴泳铭判断通往 ASI 分三阶段,阿里为此推进 3800 亿建设计划。
经济学人:为什么 AI 还没抢走你的饭碗?
尽管先进AI模型能力强,引发人们对失业的担忧,但实际情况是,口译翻译等领域就业人数增长,年轻毕业生失业率低,白领岗位未受负面影响,全球就业仍强劲,或因AI使用率低及公司不轻易裁员。
刚刚,Dario紧急抛出AI全球共管计划!
本文报道AI行业围绕监管与发展的多方博弈,Anthropic创始人Dario抛出AI全球共管计划,巨头呼吁减速AI被质疑借监管打造垄断壁垒,同时曝光两大AI巨头疯狂囤算力备战的行业现状。