降本增效」共找到 587 篇相关文章

开源动态8

微软开源新版Phi-4:推理效率暴涨10倍,笔记可运行

今天凌晨微软官网开源Phi - 4家族最新版Phi - 4 - mini - flash - reasoning,它参数小性能强,适合边缘设备。采用自研SambaY架构,推理效率涨10倍,延迟2 - 3倍,多场景测试表现优异。

AIGC开放社区
产品应用8

OceanBase全面拥抱AI新进展:OB Cloud支持十亿级多类型向量数据,数十家企业实现AI应用落地

大模型热潮下,企业面临AI落地难题。OceanBase的OB Cloud支持十亿级多类型向量数据,已有数十家企业实现AI应用落地。它具备多云原生、AI能力优势,提供一体化架构和多模向量一体化,还低了AI应用门槛。

量子位
算法论文8

更多thinking≠更好结果,精准thinking可砍掉一半长度

当前大模型如GPT - 4、DeepSeek推理又长又啰嗦,论文发现其在简单题目上过度推理。作者提出‘无效思考’概念,还给出解决原则,用LC - R1方法训练,效果显著,揭示精准思考才是王道。

深度学习自然语言处理
算法论文8

JCP | 南科大赵肃楠、王建春等:LESnets:基于物理信息神经算子的湍流大涡模拟

研究提出基于物理信息神经算子的LESnets方法,用于快速模拟粗网格上三维湍流时空演化。不使用标签数据,训练两种神经算子,验证了其有效性和泛化能力,效率显著优于传统方法。

力学与人工智能
算法论文8

模型越聪明越“不听话”?MathIF基准揭示AI服从性漏洞

上海人工智能实验室与香港中文大学研究团队发布论文,用MathIF基准揭示大模型“聪明”和“听话”有矛盾,越擅长推理越易忽略指令,还分析了原因并给出让模型更“听话”的方法。

深度学习自然语言处理
新闻资讯7

向量数据库要被取代?DynamoDB 开始原生支持 AI 搜索

Amazon DynamoDB 推出原生向量搜索,允许开发者将嵌入向量与应用数据存一起,直接在其中运行近似最近邻查询,无需单独向量数据库。介绍了功能特点、成计费及开发者反馈等。

InfoQ
产品应用7

用Codex做跨境电商:第二章

章探讨为何选Codex承载跨境电商工作方法。它将多种功能置于同一工作环境,适合跨境卖家沉淀业务资产。Codex不仅能写代码,还能围绕项目完成读材料、写产出、受控执行等任务。

newtype AI
新闻资讯7

Karpathy刚进Anthropic,转头又投了它

AI初创公司Engram成立8个月,估值达6亿美金,获9800万美元融资。它聚焦AI记忆,用Cartridges技术内存、提速度,将推理和记忆层拆开,团队成员背景强大,押注AI范式新转向。

新智元
算法论文8

AMD新论文颠覆认知:FP4训练不稳定,原因不是随机性不足

大模型训练成高,低训练精度可。AMD联合宾州州立大学论文颠覆认知,揭示FP4训练不稳定源于结构性微缩放误差,非随机性不足,还在原生FP4硬件完成大模型预训练。

机器之心
产品应用7

Claude Opus 4.7来了,公开模型里的SOTA!不过用起来GPT味好浓

Anthropic推出Claude Opus 4.7,虽有像GPT的争议,但在多方面表现出色。它在高级软件工程、视觉能力等四大方向升级,且具备防护措施和记忆增强。全平台开放,与Opus 4.6同价,使用有注意事项。

量子位