等变建模」共找到 8385 篇相关文章

推荐文章7

万字长文!大模型LLM推理优化技术总结

文章围绕大模型LLM推理优化技术展开,先介绍LLM推理各阶段、批处理、KV缓存概念及内存需求,再阐述模型并行、注意力机制优化、模型优化和模型服务技术,如Pipeline并行、MQA、量化、动态批处理

OpenMMLab
新闻资讯7

AI教父Hinton警告:有志于编程,不必读大学!

新智元报道,AI教父Hinton警告AI正在颠覆编程岗位,美国超1/4编程职位已消失。探讨大学是否还应教编程、CS是否值得学,还提及程序员求职难现状及未来技能需求趋势。

新智元
产品应用7

胜率直逼人类大师!这套Agent揭开中国AI「玄学真相」

在无信息泄漏的术数题库中,Claude、GPT主流模型准确率低,而Tianfu Agent系统将准确率提至50%,逼近人类Top20选手。它采用多Sub - Agent协作策略,还在工具管理、规则使用方面有创新。

新智元
新闻资讯8

2025「中国最具价值 AGI 创新机构 TOP 50」发布

2025年中国AI行业新应用、新产品不断涌现。Founder Park从商业价值创新四维度选出50家AI创业先锋,涵盖大公司新产品、垂直赛道头部公司和初创企业,还介绍了如阿里生意管家、ACE Studio众多创新产品。

Founder Park
算法论文7

deepseek-V4算法工程技术深入浅出

文章围绕deepseek V4技术报告展开,指出当前大模型训练不充分,介绍了算法层面如混合注意力机制、模型结构优化、优化器,工程层面如细粒度专家并行、算子内核开发,以及后训练的范式转和领域专家网络蒸馏内容。

Agent的潜意识
算法论文8

ENG APPL COMP FLUID | 西北工业大学赵书乐、张伟伟:欧拉方程嵌入的壁面压力和摩阻分布机器学习方法

传统气动力建模依赖大量样本、泛化能力弱。本文将欧拉方程无粘特征融入建模,配合架构与损失函数设计,让模型在复杂状态保持泛化能力,集中力误差约3%,小样本建模时样本量比传统方法降2倍以上。

力学与人工智能
算法论文7

清华唐杰新作:大模型能打掼蛋吗?

清华、北邮团队联合研究表明大模型能打掼蛋8种棋牌。不同模型在不同棋牌表现有差异,如GPT - 4o综合佳,GLM4是“全能型选手”。研究还探讨学习方法、模型性能影响因素及游戏间相互作用

量子位
新闻资讯8

深度讨论新一轮模型发布:当智能进入月更时代 | Best Ideas

近期全球模型迎来高密度发布期,Anthropic、OpenAI、腾讯、DeepSeek 纷纷推出新模型。文章复盘了 Opus 4.7、GPT - 5.5、DeepSeek V4 模型实测体验,探讨架构化、能力边界与产业影响,还分析算力、token 价格问题。

海外独角兽
开源动态8

HAMi 2.7.0 重磅发布 | 异构芯片全面拓展,调度更稳、生态更强

Dynamia密瓜智能宣布发布HAMi 2.7.0版,在硬件生态、调度器、应用层生态方面有显著进展。硬件上支持昆仑芯、燧原、AWS芯片;调度器优化了资源计算和可观测性;应用层与vLLM、Xinference整合。

InfoQ
新闻资讯7

御三家都在押注的 Loops,代码怎么还是垃圾?

在AIE World's Fair大会的《伟大的Loops》辩论赛上,正反方就Loops展开激烈交锋。正方认为Loops配得上热度,是迈向软件工厂关键一步;反方则指出其炒作与实际效果差距大,当前做法有误。双方还探讨了安全性、可用性、开销问题。

AI前线