「调用链」共找到 648 篇相关文章
连Karpathy都怕了!9千万级AI包被投毒,竟靠黑客写出bug救命
3月24日,AI应用核心工具LiteLLM更新版本含恶意代码,可窃取开发者核心信息。因攻击者代码有bug致机器崩溃才暴露。这引发AI基础设施信任危机,Karpathy称要减少依赖。
我在手机上也能操作AI OS
作者介绍其AI操作系统,由OpenCode加newtype Profile插件及内容仓库构成。此前只能桌面端操作,现通过OpenCode服务器模式和Discord bot,实现手机与系统打通,让记忆资产随时可用,提升内容生产效率。
告别JSON冗余:TOON让Token成本降低30-60%
LLM交互用JSON有冗余,成本高、速度慢。TOON格式专为LLM优化,结合YAML和CSV特点,比JSON减少30 - 60%的token消耗,还介绍了特性、上手方法、集成实践和适用场景。
大模型收入暴涨1076%,港股AGI第一股首份年报:一年狂揽12亿,属实把商业化玩明白了
港股AGI第一股云知声披露首份年报,全年营收12亿,大模型业务收入暴涨1076%成核心增长引擎。其靠“强基模、深应用”战略实现业绩增长,还计划拓展MaaS模式,探索多元“第二曲线”。
2025年各大厂真实面试题,抓紧上车还有机会!!!
作者小华整理 2025 年字节跳动、腾讯、阿里大厂面试真题及题解,涵盖算法、数据库、分布式等多领域,还给出记忆方法,助找工作或刷题同学备考。
MCP 丸辣?不不不,Agent 进生产都绕不开 MCP
文章指出 Agent 连接外部系统通常有直接 API 调用、CLI 及 MCP 三种方式,构建生产级 Agent 目前 MCP 更靠谱。分析各方式优劣,还介绍了 MCP 封装方法。
你的「龙虾」真记得你吗?剑桥发布长期个性化记忆基准ATM-Bench
剑桥大学团队开源面向AI个人助理的长期记忆基准测试ATM - Bench,评估AI面对真实生活数据时能否「记住你」。实验结果不佳,专用和通用智能体系统准确率低,凸显长期个性化记忆问答难题。
刚刚,阿里旗舰模型Qwen3-Max-Thinking发布,编程能力“踢馆”Gemini与Claude
阿里发布旗舰模型Qwen3-Max-Thinking,总参数超1万亿,在多项权威基准测试中表现优异,可与顶级闭源模型竞争。千问团队为其引入两项核心创新,提升推理性能,该模型已可免费体验。
The Batch: 896 | 教会模型说出真相
大型语言模型有时会隐瞒未遵守约束条件的事实。研究人员微调 GPT - 5 Thinking,使其违规时能‘自白’。通过强化学习训练,测试显示微调模型在多项评测中多能承认问题,自白机制可监控模型行为。
零代码、100%本地!三步生成企业级MCP,Postman这个新功能绝了~
作者发现Postman新增MCP Generator功能,拖拖点点就能构建MCP Server。以公共的HackerNews为例,介绍了筛选API、生成代码、配置Client三步生成企业级MCP的过程,还指出此功能适合快速接入标准化REST API。