「运行时学习」共找到 2449 篇相关文章
ICML 2025 Oral | 从「浅对齐」到「深思熟虑」,清华牵头搭起大模型安全的下一级阶梯
在大语言模型加速进入高风险应用场景当下,“安全对齐”是挑战。如今广泛采用的“浅对齐”脆弱不堪。清华团队提出STAIR框架,能提升开源模型鲁棒性,还推出RealSafe - R1模型进行安全对齐。
ThinkChain:一个让Claude边调用工具边思考的开源框架
ThinkChain是展示Claude高级能力的Python项目,其核心创新是将工具执行结果注入Claude思维流,改变AI与工具交互方式。它支持零配置启动,有丰富工具集,还具备交互式命令等特性。
基于MCP协议的12306购票搜索服务器项目解析(附配置流程)!
文章介绍基于MCP协议的12306购票搜索服务器项目12306 - mcp,涵盖功能特点、技术架构、服务原理、数据流程、工具及安装配置,还给出GitHub地址,助开发者提升购票查询体验。
Memvid:把你的文档库变成一个小巧的视频,还能瞬间搜出你想要的!
传统向量数据库因高成本和复杂运维让开发者却步。开源项目Memvid将文本数据存入视频文件,能高效检索,解决存储冗余、检索延迟和网络依赖问题,使用简单,虽处概念原型阶段但值得尝试。
mem0推出王炸mcp工具OpenMemory,打造用户私有、跨应用的共享记忆层
mem0项目推出OpenMemory MCP,这是专为兼容MCP的AI客户端设计的私有记忆层,能解决跨AI工具的Context共享问题。它强调隐私和本地控制,功能实用,获用户积极反馈。
中国AI突破「造芯方法论」!Agent军团接管芯片设计全流程
RSI成人工智能前沿方向,芯片设计因有确定性验证体系,成其率先落地赛道。NovaSilicon完成融资,探索出芯片设计智能系统,发表论文介绍构建运行方法,将重塑行业。
“额度想重置就重置,不问财务”,Codex Tibo首曝幕后:产品没做好,就补偿用户
围绕 Codex 与 Claude Code 使用额度问题,社区不满额度机制不透明不可预测。Codex 团队 Tibo 公开额度重置逻辑源于补偿,并非营销。此外,还谈及产品融合、技术创新、算力决策等多方面内容。
Stripe 发布基准测试:AI 智能体可开发集成方案,但校验环节存在短板
Stripe推出基准测试套件,评估AI智能体构建完整Stripe集成方案的能力,测试聚焦金融系统贴近生产环境的集成场景。测试显示,不同任务类型评测结果差异显著,核心瓶颈在于验证环节,当前智能体短板在校验逻辑等方面。
Claude Code官宣下一版大升级!你在聊天,后台把活干完了
Claude Code创造者Boris Cherny官宣,下一版子智能体默认在后台跑,可边聊边干活。其半年来不断进化,还让Anthropic工程师产出翻三倍,在Spotify实战效果也佳,改变了工程师角色。
第九章 编码 Agent 实战——用 Deep Agents 构建代码审查助手
文章围绕用 `deepagents` 框架构建代码审查 Agent 展开。介绍 `deepagents` 核心能力、安装配置,给出最小可运行示例。还阐述自定义工具及使用方法,添加审查 Skill 明确审查标准和流程。