性能对比」共找到 2316 篇相关文章

开源动态8

Kimi K2发布两天即“封神”?80%成本优势追平Claude 4、打趴“全球最强AI”,架构与DeepSeek相似!

国内独角兽月之暗面发布并开源 Kimi K2 模型,推出两天就在 OpenRouter 平台 token 使用量超 xAI 的 Grok 4。它成本低、性能强,编码能力追平 Claude 4,架构与 DeepSeek 相似,技术研究也多次‘撞车’。

InfoQ
推荐文章7

从Manus热潮看中国科技出海:新加坡能否成最佳首站?

AI Agent 公司 Manus 将总部迁至新加坡,凸显其优势。白鲸开源创始人郭炜分享中国科技企业出海经验,对比 A、B 路径,分析中美市场差异,探讨中国软件市场优劣势,还阐述开源商业化及新加坡作为出海首站的价值。

InfoQ
算法论文8

ICML 2025 | 给AI装上「智能升级插件」!阿里安全-清华大学D-MoLE让模型在持续学习中动态进化

近日,阿里巴巴集团安全部 - 交互内容安全团队与清华大学联合研究成果被 ICML 2025 收录。他们提出 D - MoLE 框架应对多模态大模型持续学习挑战,实验显示其性能优、训练快,还能用于提升阿里安全审核模型适应力。

机器之心
算法论文8

ICML2025|宁波东方理工大学刘野,陈云天:DragSolver:用于真实汽车风阻系数估计的多尺度Transformer方法

当汽车高速行驶,空气阻力影响车辆性能。传统风阻系数测算方法耗时久,难以满足实际需求。宁波东方理工大学等机构研究者提出DragSolver模型,能快速准确估计风阻系数,经实验验证效果优,有降本增效等价值。

力学与人工智能
推荐文章7

【博客转载】CUDA Local Memory

文章围绕CUDA本地内存展开,介绍其为线程私有存储空间,访问特性与全局内存类似。通过两个计算滑动平均值的CUDA kernel示例,展示数组索引复杂度对存储位置的影响,还给出判断存储位置的方法及优化建议。

GiantPandaLLM
推荐文章7

上下文就是一切!行业热议话题:提示工程是否应该改名

AI圈热议提示工程是否应改名“上下文工程”。Shopify CEO等发表看法,指出其在LLM应用和AI Agent构建中很重要,还分析了重要性、优化方法,给出实践经验,强调要在性能、成本和准确性间平衡。

歸藏的AI工具箱
算法论文8

监督学习也能从错误中学习反思?!清华英伟达联合提出隐式负向策略爆炸提升数学能力

清华大学与英伟达、斯坦福联合提出监督学习方案NFT,在RFT算法基础上构造“隐式负向模型”利用负向数据训练。该策略弥合监督与强化学习差距,其损失函数梯度和GRPO在On - Policy条件下等价。

量子位
算法论文8

通向世界模型关键一步:EX-4D来了,实现单目视频到自由视角生成

去年Sora等模型革新视频生成领域,相机可控的视频生成技术是构建世界模型核心。但从单视角生成极端视角视频是难题,PICO - MR团队提出EX - 4D,能从单目视频生成新视角视频,多方面表现出色。

机器之心
新闻资讯7

苹果的局面,很迷惑

作者对比 Google I/O 大会上谷歌的表现,认为苹果在 WWDC 上的表现令人失望。苹果更新设计语言,其 AI 侧重端侧模型,有数据安全等优势,虽目前参数量小,但端侧 AI 或成新战场。

MacTalk
推荐文章8

5 万行代码 Vibe Coding 实践复盘:最佳实践、关键技术,Bitter Lesson

大厂资深工程师分享 3 个月用 AI 写 5 万行代码的体验,介绍 Vibe Coding 实践,分析 Coding Agent 关键技术如语义搜索、MCP,对比 Cursor、GitHub Copilot、Cline 等产品,还提到 Agent 开发要避免过度植入人类经验。

海外独角兽