复合LLM应用」共找到 3019 篇相关文章

推荐文章8

造过 Codex 的人,为什么每天用 Claude Code

Calvin曾带队构建编程Agent Codex,如今日常用Claude Code。他和Garry Tan在播客聊了编程Agent的产品哲学差异、分发逻辑等。Claude Code拆分上下文表现出色,LLM成开发者工具推荐引擎,还探讨了构建、使用编程Agent的要点。

宝玉AI
开源动态8

能让DeepSeek自进化的Harness!LlamaFactory作者开源新工具:0.2元自动造Agent

LlamaFactory作者郑耀威团队开源的PenguinHarness,是全球首个支持多Agent自进化的Harness,能自动构建、评测和改进Agent。它成本低、速度快,适配众多模型,还有严格契约保障安全。已在生产场景应用,效果显著。

机器之心
算法论文8

ICML 2026 | Agentic强化学习训练的信息自锁问题

随着大语言模型走向真实交互,强化学习训练LLM agents时出现信息自锁问题。香港中文大学等研究者分析其原因并提出AREW方法,在多场景实验中表现稳定且具鲁棒性。

机器之心
产品应用7

本地可运行的高质量的文本转语音模型

介绍Kyutai的Pocket TTS,一款轻量级文本转语音应用,可在CPU高效运行,模型小且低延迟,支持Python API和CLI,能语音克隆,还可在浏览器试用,目前仅支持英语,也有社区浏览器端实现。

GitHubStore
产品应用7

把 AI Coding Agent 搬进终端:Crush 让你的命令行变成“编程搭子”

Crush是Charmbracelet出品的终端AI编程代理,可将工具、代码和工作流接到所选LLM,在终端协同工作。它有多模型、会话制等特点,适合终端重度用户等,还介绍了安装、使用及进阶玩法。

小华同学ai
产品应用7

Hexstrike AI在多个工具及模型上的渗透测试表现

文章围绕Hexstrike AI在多个工具及模型上的渗透测试展开。介绍测试环境,用不同难度靶机测试。分析Claude desktop+Sonnet 4.5、AIaW+Deepseek、Cursor+多个模型等组合表现,指出LLM辅助渗透测试任重道远。

AI与安全
算法论文8

AI终于学会「读懂人心」,带飞DeepSeek R1,OpenAI o3等模型

威斯康星大学麦迪逊分校联合清华大学的研究《MetaMind: Modeling Human Social Thoughts with Metacognitive Multi-Agent Systems》,将元认知理论融入LLM架构,让AI“读懂人心”。其框架分三阶段,还有动态社交记忆,在多基准测试表现出色。

机器之心
新闻资讯8

啊?微博7800美元训的大模型,数学能力超了DeepSeek-R1

近日,微博发布自研开源大模型VibeThinker,15亿参数却在数学测试上击败6710亿参数的DeepSeek R1,后训练成本仅7800美元。其为AI产业带来新思考,还将推动微博AI应用发展。

量子位
新闻资讯8

“技术迭代速度是唯一护城河!”李彦宏把百度 AI 秀了个遍,还称芯片拿大部分钱的 AI 生态不健康

李彦宏在百度世界大会指出,AI产业结构正从‘正金字塔’向‘倒金字塔’转变,健康生态中应用应创造最大价值。百度展示多项成果,如数字人、AI搜索等,还发布文心大模型5.0和百度伐谋。

AI前线
算法论文8

谢赛宁×李飞飞×LeCun首次联手!寒武纪-S「空间超感知」AI震撼登场

Yann LeCun、李飞飞和谢赛宁联手发布论文「Cambrian - S:迈向视频中的空间超感知」。他们认为LLM虽能力强,但无法像人类一样感知世界,为此构建Cambrian - S系列模型,开源相关数据和模型,还开发了新原型。

新智元