「成本低」共找到 2068 篇相关文章
杨植麟亲自发布,月之暗面最强模型Kimi K2.5开源
杨植麟发布月之暗面最强模型Kimi K2.5,经约15万亿视觉与文本混合数据预训练,有顶尖编程与视觉能力及智能体蜂群范式。在多基准测试表现优,成本低于对手,还能提升办公生产力。
2M大小模型定义表格理解极限,清华大学崔鹏团队开源LimiX-2M
大语言模型在结构化表格数据处理上表现不佳,清华大学崔鹏团队开源的 LimiX-2M 模型,仅 2M 参数,却能同时支持分类、回归等任务,性能超越经典模型,且训练、运行成本低,科研友好。
被H-1B签证折磨10年,前微软科学家用AI「掀桌」
美国签证体系成本高、周期长、透明度低,前微软科学家Priyanka Kulkarni创办Casium,用AI改造签证服务,把材料准备时间大幅缩短,近期获500万美元种子轮融资。新规下,其服务更显重要。
WorkBuddy杀疯了?一群AI专家帮我打工,我在微信里当赛博虾工头!
本文介绍腾讯推出的全场景职场AI智能体桌面工作台WorkBuddy。它内置多领域垂类专家,能接管自媒体内容创作流水线,还接入微信ClawBot插件方便操作。部署和技能配置门槛低,内置主流模型,还有免费Credits福利。
北大提出首个复数大模型,2比特量化,推理仅加法,可手机部署!
北大团队提出iFairy方案,将模型权重量化到复数集合,用2比特表示,压缩至原本1/8。推理仅需加减或交换数据位置,成本更低。Transformer架构“复数化”,iFairy模型PPL降10%,性能反超全精度,相关成果已开源。
Cursor Composer 2.5 拆解:最强大的 RL 环境,就是你自己的产品
今年5月,Cursor推出Agentic编程模型Composer 2.5,相比前代能力更强、成本效率更高。Cursor研究负责人认为最强大的RL环境就是自己的产品,文中还介绍了Composer 2.5训练方式、面临的挑战及解决办法等。
TreeHop:无需LLM的高效多跳问答新范式
多跳问答(MHQA)任务有挑战,现有方法依赖LLM,计算成本高、延迟显著。TreeHop研究提出新方案,摒弃LLM,通过嵌入空间动态更新,降低延迟、减少模型参数量,还在主流数据集表现佳,适合工业应用。
被轻视的巨大市场,大厂做不好的Local Agent为何难?| 甲子光年
文章指出大模型边际收益递减,AI竞赛规则生变,产业从‘参数竞赛’转向‘效率革命’。本地Agent有潜力,但主流产品体验差。GreenBitAI深耕低比特模型,推出Libra,有望撬开万亿美元增量市场。
推翻「预测下一个token」范式!微信AI新研究:把token压缩成连续向量更具性价比
微信AI和清华团队提出新范式CALM,把token打包成连续向量,让大模型从预测下一个token转变为预测下一个向量。实验表明它能减少生成步骤,在平衡性能和计算成本时性价比更高。
二十年老牌 IDE 栽在 AI 上!JetBrains 被差评逼疯批量删除评论,用户怒打更多1星抗议
JetBrains 2023 年 12 月发布的 AI 助手插件下载超 2200 万次,但评分仅 2.3 分。该公司批量删负面评论引用户不满,其还存在安装难移除、体验差等问题。虽推出免费套餐和 Junie 智能体,仍面临成本和竞争压力。