「AI 模型构建」共找到 14024 篇相关文章
统一架构新思考,北大团队UniWorld-V1统一大模型
北大袁粒课题组提出统一大模型架构UniWorld-V1。通过对GPT - 4o - Image实验,发现其依赖语义编码器提取视觉特征,据此设计架构,在多基准测试表现优异,开源代码等促进研究。
奥特曼亲自操刀,为日韩定制「AI强国」蓝图
OpenAI近日接连发布《日本经济蓝图》和《韩国经济蓝图》,标志其亚太战略从「产品输出」升级为「国家级合作」。在韩提出「双轨战略」,在日以「三支柱」计划为核心,助力两国借AI提升全球地位。
RTP-LLM 在相关性大模型中的推理优化最佳实践
淘宝搜索场景引入大参数LLM模型,面临系统性能挑战。本文分享基于RTP - LLM框架的优化实践,如大BatchSize调度、批次内前缀复用、MoE Kernel动态调优等,还提及未来优化方向。
谷歌AI研究员,潜入梵蒂冈游说教皇:AGI将带来末日!
当硅谷争论AI何时超人类,前谷歌研究员莱文带“AI复仇者联盟”赴梵蒂冈,想让教皇正视AGI风险。他担心巨头先“安抚”教会,虽未与教皇交流,但发现梵蒂冈对AGI较开放。
AI+直播的新玩法! StreamDiffusionV2让创意零延迟
生成模型改变直播行业,但此前模型难保证时间一致性、有延迟等问题。加利福尼亚大学推出StreamDiffusionV2,通过智能调度和缓存机制优化,支持多GPU并行,可灵活调画质和延迟,实现实时直播。
Jeff Dean最新访谈:未来开发者人均50个智能体,写需求成核心技能
谷歌首席AI科学家Jeff Dean在访谈中预言,未来开发者人均管理50个智能体,写需求成核心技能。他还揭秘谷歌帕累托前沿策略,介绍蒸馏技术让小模型接近大模型性能,强调多模态及低延迟价值,给出未来模型发展预测。
德克萨斯州总检察长指控Meta、Character.AI,误导儿童心理健康
Techcrunch消息,德克萨斯州总检察长Ken Paxton对Meta AI Studio和Character.AI展开调查,因其从事欺骗性贸易行为,误导性宣传为心理健康工具,可能误导儿童。此前已有对Meta调查,两公司均称有免责声明。
人工智能研究者如何意外发现:我们对“学习”的理解,可能全是错的
传统理论认为大模型会过拟合,而如今大模型却驱动了诸多应用。2019年研究者突破传统扩大模型规模,出现‘双下降’现象。‘彩票假说’解释其成功原因,还重新定义了‘智能’,揭示科学进步规律。
Clawdbot爆火:Karpathy点赞的开源AI助理,到底是什么?
这两天AI圈被Clawdbot项目刷屏。它是能在手机已有应用中工作的AI助理,有记忆、会主动联系用户、能执行任务。它可在廉价云服务器运行,能力分两层级,成本每月25 - 150美元。
慧荣科技苟嘉章:AI大厂重塑存储需求基本盘
在CFMS |MemoryS 2026峰会上,慧荣科技总经理苟嘉章指出AI大厂重塑存储需求,苹果排名下滑。慧荣科技展示多领域产品,推出主控芯片,在技术路线上有取舍,还谈到“Physical AI”及端侧分工。