参数化知识注入」共找到 1267 篇相关文章

产品应用8

AI云的大考来了:企业要的不再是参数,而是盈利 | 甲子光年

历经3年大模型热潮,AI云市场提问改变,企业更关注平台模型实用性和故障恢复能力。百度云智大会聚焦新一代智能基础设施与平台升级,其智能云连续六年排名第一,此次升级回应企业落地AI的核心问题。

甲子光年
产品应用8

单机狂飙4万亿参数,国产AI「四大天王」首次合体!这台超节点鲨疯了

国产「四大开源天王」可在单机运行,背后是「元脑SD200」超节点。它有超大显存、高速互联域和超强算力,支持64路本土GPU且可商用。浪潮信息以开源为战略加速大模型商业化落地。

新智元
开源动态8

一个模型超了DeepSeek R1、V3,参数671B,成本不到350万美元

Deep Cogito 是旧金山 AI 初创公司,开源四款混合推理模型。最大 671B MoE 模型性能超 DeepSeek v3 等,推理链比 DeepSeek R1 短 60%,训练成本不到 350 万美元。核心方法是迭代蒸馏与增强。

机器之心
算法论文8

参数量暴降,精度反升!哈工大宾大联手打造点云分析新SOTA

哈工大(深圳)和宾大联合团队推出基于KANs的3D感知解决方案PointKAN,能处理点云数据下游任务。它替代MLP,有更强学习几何特征能力。还提出PointKAN - elite,降参保量。实验表现出色。

量子位
新闻资讯7

首次曝光!OpenAI新一代旗舰Astra换上“循环深度”推理架构:用计算深度换参数规模

9月2日消息,OpenAI将推出的旗舰模型Astra采用“循环深度”新技术,用较小模型实现庞大模型性能,降低成本。但该技术会让AI推理过程不可读,加重安全担忧,此前奥特曼已因Astra“能力过强”踩刹车。

AI前线
新闻资讯7

视频版Nano Banana来了!内置Gemini世界知识;原版香蕉出图仅需4秒

谷歌开放Gemini Omni Flash API,将多模态推理与视频生成编辑结合,有4项关键能力,也有局限。Nano Banana 2 Lite出图快且便宜。二者串联使用,图像生成与视频创作可无缝衔接。

量子位
开源动态8

6.6K标星!微软开源Agent自我优化框架,为智能体注入持续学习能力!

开发AI Agent常面临部署后难自动优化的问题。微软开源的Agent Lightning,加几行代码就能让Agent自动学习、持续优化,有事件追踪等核心能力,安装简单,应用场景丰富。

开源星探
推荐文章7

给企业应用注入AI:架构师需关注的3大工程挑战与9种设计模式

文章指出企业常将AI引入现有应用,集成时要考虑系统风险。介绍架构师需关注的3大工程挑战及9种设计模式,含可用性、性能、安全增强相关模式,助企业让AI应用从“能用”变“好用”。

AI大模型应用实践
算法论文7

JFM | 西北工业大学杨忠鑫、张伟伟等:数据驱动的特定且可泛化的湍流封闭知识发现

本文基于高精度数据结合符号回归等方法重建混合长理论,提出解决泛化性问题的策略。通过槽道等基本流动获普适公式,用于封闭求解RANS方程,在工程附着流中提升精度,为飞行器摩阻预测提供新工具。

力学与人工智能
开源动态8

谷歌开源Gemma 3n:2G内存就能跑,100亿参数内最强多模态模型

本周五凌晨,谷歌正式发布、开源全新端侧多模态大模型 Gemma 3n。它有多模态设计、专为设备端优化等特性,核心是 MatFormer 架构,还采用了 PLE 技术等,在多方面实现质量提升。

机器之心