「降本方案」共找到 1379 篇相关文章
一个邪修方法,帮你把用Agent的钱省掉80%。
作者曾分享Minimax的Agent,因使用成本高遭读者反馈。现该工具推出Publish to Gallery & Remix功能,用户可复用项目,降低成本,还能形成集体智慧。不过产品和交互设计较粗糙。
Meta将推出闭源模型,并砸数千亿美元打造超算集群
Meta正在酝酿大转向,扎克伯格宣布砸数千亿美元建超算集群,还考虑将强大AI模型Behemoth从开源转闭源。此前Meta一直高举开源大旗,如今因模型内部表现不佳等因素动摇开源信仰。
Cache Me If You Can:陈丹琦团队如何「抓住」关键缓存,解放LLM内存?
普林斯顿大学陈丹琦团队新论文聚焦长上下文语言模型 KV 缓存问题。传统 KV 缓存大小随输入文本长度线性增长,此前方法难公平比较。团队提出「KV 足迹」指标,改进方法并推出 PruLong 优化内存,节省空间且保性能。
华为版《黑客帝国》首次亮相:训推复杂AI前先“彩排”,小时级预演万卡集群
华为首次亮相数字化风洞虚拟环境平台,可在训推复杂AI模型前“彩排”,小时级预演万卡集群。其包含Sim2Train、Sim2Infer、Sim2Availability,分别解决训练、推理、高可用问题。
刚刚,OpenAI最强推理模型o3-pro诞生!碾压Gemini 2.5 Pro击穿底价
OpenAI昨夜官宣上线最强推理模型o3 - pro,还将o3价格暴降80%。o3 - pro专为深度思考和提供超可靠答案而生,在多项测试中表现优异,虽有速度慢等限制,但优势明显,网友实测效果惊艳。
SSM+扩散模型,竟造出一种全新的「视频世界模型」
在AI热词不断涌现的时代,斯坦福大学等机构研究将长上下文、状态空间模型、扩散模型等结合,创造全新「视频世界模型」。它用状态空间模型实现长期记忆,还设置局部注意力机制,训练和推理表现出色。
ACL 2025 高分接收 | 高感情语音技术:逻辑智能小语种TTS破局之道
语音合成技术在大语种发展好,但小语种因语料稀缺等面临挑战。逻辑智能团队提出针对低资源语言TTS的解决方案,构建泰语数据集,经先进预处理,其TTS模型效果好,有零样本克隆能力。
ChatGPT转型计划曝光!不再只是回答问题,而是通过穿插使用工具变身行动助手
OpenAI CPO Kevin Weil在访谈中透露,ChatGPT将从回答问题转变为为用户做事,通过穿插使用工具解决复杂问题。当下模型成本已是GPT - 4的500倍,未来将不断降低API价格,还提及模型效率突破关键等内容。
参数量暴降,精度反升!哈工大宾大联手打造点云分析新SOTA
哈工大(深圳)和宾大联合团队推出基于KANs的3D感知解决方案PointKAN,能处理点云数据下游任务。它替代MLP,有更强学习几何特征能力。还提出PointKAN - elite,降参保量。实验表现出色。
2025年哪款模型最受欢迎?Poe最新报告:DeepSeek降温、可灵成黑马
AI工具聚合平台Poe发布2025年1 - 5月人工智能模型使用趋势报告。显示模型市场份额消长明显,推理模型势头正劲,图像、视频、音频生成领域各有竞争态势,如DeepSeek降温,可灵成视频生成黑马。