「模型通用性」共找到 8321 篇相关文章

新闻资讯7

高通要发两款AI推理芯片,资本市场反应强烈

高通周一宣布明年推AI200芯片,2027年跟进AI250,股价应声上涨。两款芯片基于移动神经处理技术,专攻AI模型部署,沙特AI公司已计划采用,高通想借此进军AI芯片市场。

AI工程化
推荐文章8

社会身份的价值:从专业证书到个人品牌,如何最大化你的身份价值?深度拆解知识博主、行业协会KOL的崛起之路

报告解构社会身份资本体系,指出当代职业人士面临制度化与涌现性资本抉择。梳理五类身份资本,分析投入产出比,强调结合两者实现杠杆效应,还探讨了AI时代身份价值重塑。

AI Reading Hub
开源动态8

阿里开源 Vivid-VR!带来逼真连贯的视频修复

阿里开源 Vivid - VR 用于视频修复,基于 T2V 模型结合 ControlNet 保证画面一致性。它引入概念蒸馏训练策略,设计控制特征投影器和双分支 ControlNet 连接器,实验展现出优异表现。

带你学AI
新闻资讯7

LLM抢人血案:强化学习天才被挖空,一朝沦为「无人区」!

斯坦福AI+CS博士Joseph Suarez回顾强化学习历史,指出其曾因学术短视、学界追名逐利走向衰落。如今他坚持用小模型从零开始的RL,重建标准,让研究速度和效果大幅提升。

新智元
算法论文8

北航LiveRepoReflection: 扭转乾坤-仓库级代码反射

本文提出LiveRepoReflection基准,评估多文件仓库代码理解和生成能力,含1888个测试案例。创建RepoReflection - Instruct数据集训练RepoReflectionCoder,评估40多个LLMs,结果显示其能有效测模型反思修复能力。

PaperAgent
推荐文章8

OpenAI核心研究员:比提示词工程更重要的,是spec-writing

OpenAI研究员Sean Grove在AIEWF 2025演讲提出,程序员最有价值技能是向AI传达意图,完善规范是含完整意图的「源代码」。他还分享软件工程看法,涉及规范执行、模型训练等内容。

Founder Park
产品应用7

Claude Code 作者:别再沉迷功能堆砌了!最好的 AI 工具,是把控制权还给你

Claude Code 创造者 Boris Cherny 提出“极简主义哲学”,认为最好的 AI 工具应是简单、通用、无偏见的“乐高积木”,把控制权还给用户。还回顾编程发展,介绍开发体验进化及 Claude Code 工作流。

AI科技大本营
产品应用8

昇腾+鲲鹏联手上大招!华为爆改MoE训练,吞吐再飙升20%,内存省70%

最近华为在MoE训练系统给出算子和内存优化新方案,三大核心算子全面提速,系统吞吐再提20%,Selective R/S实现内存节省70%,为大规模MoE模型训练扫清障碍。

新智元
新闻资讯7

AI逼疯七巨头,马斯克们深陷中年危机!

人工智能来势汹汹,科技巨头们陷入「AI焦虑」。谷歌搜索危机、苹果AI滞后、马斯克的特斯拉销量滑坡,巨头们面临挑战,谁会成AI时代「诺基亚」尚不明朗,新兴模型也带来新变数。

新智元
算法论文8

社交Agent: 通过RL学习自适应Thinking,根据场景在“秒回”和“深思”间灵活切换

现有聊天机器人在人情世故场景表现不佳,论文指出大模型思维‘一根筋’。研究团队设计4种思维模式,用AMPO强化学习算法动态切换。在模拟社交任务中,AMPO表现超GPT - 4,省时高效。

深度学习自然语言处理