「饿了么」共找到 5822 篇相关文章
经验记忆黑科技:LightSearcher让AI工具调用减39.6%、推理快48.6%
现有的 RL 驱动的深度思考大模型系统面临准确率与效率的「跷跷板」困境,北邮百家 AI 团队提出 LightSearcher 框架,解决了这一痛点,在保持准确率的同时,显著提升了工具调用效率。
DeepMind一篇论文终结十年之争!GPT-5推理靠世界模型
GPT-5上线后推理能力惊人。最新研究揭示通用智能体聪明的原因是长出“世界模型”,终结了学界十年关于AI靠模仿还是思考的争论,实验也验证了世界模型对智能体的必要性。
观猹,中文互联网最大的谐音梗 AI 社区
本文介绍了「观猹」平台,它被称为「中文互联网最大谐音梗社区」。其名字谐音「观察」,还有「猹馆」谐音「茶馆」,活跃成员群名也玩梗,平台还开了「瓜棚」即商城,会持续丰富内容。
Anthropic的多智能体,真的有必要吗?
作者曾质疑多智能体系统,看了Anthropic对「Claude Research」的说明后有了改观。介绍了多智能体系统定义、性能提升、代价,还阐述构建方法、评估方式,公开三个核心提示词及协作模式。
从零开始200行python代码实现LLM
文章从传统思路实现诗词生成器入手,介绍了词汇表、Bigram模型等概念,接着用Python和PyTorch实现了真正的Bigram模型,阐述模型、训练等内容,最后回顾成果,下一篇将基于此实现完整GPT。
大模型微调知识与实践分享
文章详细介绍大型语言模型(LLM)微调知识与实践,包括模型结构、参数量等知识,以及Prompt工程、数据构造、LoRA微调等技术点。还给出微调实践流程,介绍相关平台和框架,如星云、TuningFactory等。
估值 20 亿美元的语音输入法,开源平替已经 3 万 star
文章指出语音输入随着 AI 发展价值重估,介绍了开源工具 OpenLess,分析了商业订阅、开源桌面工具、大厂输入法三类玩家,给出四层评估框架,也提及开源风险,并对不同需求给出选择建议。
从答题到做实验:SciAgentGym让大模型进入科学工作流
复旦大学NLP实验室提出SciAgentGym,为科学智能体搭建工作流环境,还设计了评测集SciAgentBench。实验显示模型接入工具能提升成功率,但长流程任务性能下降。论文还提出SciForge构建训练数据,提升了模型表现。
GUI 将死,CLI 才是一切
文章指出 GUI 时代将尽,CLI 正赢下一个十年,其用户将是 Agent。介绍了 CLI - Anything 项目,它能为软件生成 CLI 接口,让 Agent 用命令行操控软件,还探讨了 Agent 命令执行权限等问题。
卡帕西:编程从写文件变成管龙虾!IDE不会凉但得换个用法
AI Coding先锋卡帕西认为,虽AI能生成大部分代码,但IDE不会被淘汰,编程玩法变了,开发工具需进化,功能要从组织文件变为高效协同智能体,还给出了新一代IDE应具备的技能。