「成本降低」共找到 2048 篇相关文章
免训练加速61倍!陈怡然团队新作DPad:仅关注「彩票token」
杜克大学陈怡然团队新作DPad,发现扩散大语言模型关注少量「中奖」token,推理速度可提61 - 97倍,还增强模型语境学习能力。DPad免训练零成本挑关键信息,实现「少算多准」。
比 Context7 更靠谱:Exa-code 靠 1B+ GitHub 与 Stack Overflow 减少幻觉
Exa团队索引超1B+文档、GitHub仓库等内容,exa - code对其混合搜索、分块处理。它是首个为编码代理制作的Web规模上下文工具,在代码幻觉评估中表现超流行网页搜索工具,核心技术有专为AI的搜索引擎和高效返回上下文。
DeepSeek 新模型曝光,即将发布
据彭博社消息,年初凭 R1 模型震动全球的 DeepSeek 正开发全新 AI Agent 模型,创始人推动团队在今年四季度发布。该模型能代表用户执行多步骤操作、基于过往行为学习改进,行业也在向 Agent 软件转型。
“边说边思考”,Mini-Omni-Reasoner 开创实时语音推理新范式
Mini - Omni - Reasoner将推理能力引入大型语音模型,开创“边说边思考”范式,实现实时语音推理与交互。推出Spoken - Math - Problems - 3M数据集,经四阶段生成流程构建。训练采用分阶段策略,性能超基础模型。
忘记大模型,英伟达:小模型才是Agentic AI的未来!
截至2024年末,Agentic AI领域获超20亿美元初创公司融资。NVIDIA研究报告显示,多数Agentic AI场景中,小型语言模型已足够强、更适配、更便宜,LLM-to-SLM迁移是必然趋势。
越可靠的AI就越人机,牛津大学:高情商模型错误率显著增加
牛津大学研究指出,训练模型变得温暖且富有同理心,会使其不太可靠且更奉承。温暖模型错误率较原始模型显著增加,对情绪上下文敏感,在用户表达情感与错误信息时失效常见。
OpenAI深夜放出GPT-5狙击谷歌!基准测试碾压前代模型,价格比Claude更便宜
北京时间8月8日凌晨,OpenAI推出GPT - 5,宣称其更智能、准确,幻觉率低。还推两款新模型,介绍了不同用户套餐。它在编程基准测试表现佳,健康领域能力突出,引发各界热议。
扣子开源全家桶,Apache 2.0加持,AI Agent又一次卷到起飞
7月26日,新一代AI Agent开发平台扣子(Coze)宣布开源零代码开发平台(Coze Studio)和调试工具扣子罗盘(Coze Loop)。二者结合已开源的Eino框架,为开发者提供全栈可用、可复用的开发工具,还采用宽松的Apache 2.0协议。
突破单token预测局限!南洋理工首次将多token预测引入微调,编程任务准确率提升11.67%
当前主流大语言模型依赖下一token预测训练,难理解跨多token完整概念。南洋理工大学提出概念感知微调(CAFT)技术,首次将多token预测引入微调,能让模型理解完整概念,多领域实验显示其可显著提升模型性能。
烧钱换能力,老员工经验作废!一线Agent厂商、用户经验亲述:抛弃技术驱动,巨额投入如何不打水漂?
InfoQ 对话来也科技 CEO 汪冠春、英科医疗 CTO 陈坤,从产品提供商和应用方角度,讲述 Agent 产品理念与应用策略。探讨定位、转型、挑战等,还提及成本、未来设想与出海经验。