「多智能体产品」共找到 7516 篇相关文章
已量产交付!芯桥半导体全栈国产GPU助推智算自主化
芯桥(北京)半导体成立于2025年3月,掌握核心自主知识产权,旗下Sinexus X200及Sinexus S200已量产,产品在多算力集群点亮。X200性能强、价格优,芯桥还提供全栈式解决方案。
强化学习没作用?人大DelTA精准识别关键token,推理正确率大幅上升
人大高瓴研究团队提出DelTA算法,不依赖经验为强化学习目标中每个token算最优权重。实验显示它适配主流强化框架,在多任务上提升base模型效果,还能让训练更稳定。
创业者闭门探讨:Make for Agent ,其实还是 Make for Human
极客公园组织「Make for Agent」主题闭门 Meetup,探讨 Agent 产品做法。交流聚焦 Agent IM、身份、人类介入、商业模式等问题,指出 Agent 需责任型通信、独立身份,产品设计要兼顾人和 Agent 需求,核心是责任设计。
Claude Code 之父最新访谈:编程已经结束、harness 将消失,Claude Code 将只有 100 行代码,loop 才是未来
Claude Code 之父 Boris Cherny 在红杉资本大会分享编程未来。他表示编程已基本解决,自己用手机操控 Agent 工作,loop 是未来,还预测 Claude Code 产品外壳未来或仅 100 行代码。
The Batch: 936 |Claude Code 内部揭秘
广受欢迎的编码智能体Claude Code近期版本意外暴露底层代码。Anthropic称是人为失误,未泄露用户数据。工程师分析发现其架构似小型专用操作系统,还揭示了潜在功能和未来规划。
一天两枚“代码核弹”:OpenAI 祭出首个“主打实时协作”的 Codex 模型,谷歌放出 Gemini Deep Think,码力冲到世界前8
OpenAI 发布 GPT - 5.3 - Codex - Spark 研究预览版,专为实时编码设计,降低交互延迟。谷歌更新 Gemini 3 Deep Think,面向科研与工程难题,在多领域测试表现出色,二者引发网友热议。
让两个大模型「在线吵架」,他们跑通了全网95%科研代码|深势发布Deploy-Master
科学计算领域开源软件多,但多数无法直接运行,制约可用性。Deploy - Master 针对此开发,通过搜索筛选工具、双模型博弈构建,将部署成功率提至 95%以上,为 Agentic Science 提供行动基座。
一键将 Markdown 和网页 AI 对话完美粘贴到 Word、WPS 和 Excel 的效率工具
PasteMD是常驻托盘的小工具,能从剪贴板读取Markdown,调用Pandoc转换为DOCX插入到Word/WPS光标位置。还有新功能,如智能识别Markdown表格粘贴到Excel等,介绍了使用、配置等内容。
Meta通过简单算术解锁LLM SoTA性能
大型语言模型训练耗算力与时间,传统模型融合方法有局限。本文提出SoCE新方法,通过筛选专家模型、非均匀加权平均融合,在多评测中实现先进性能,为LLM优化提供新思路。
OpenAI Atlas等AI浏览器暴露Web Agent安全风险!南洋理工破解底层机制
OpenAI Atlas等AI浏览器提升网页自动化效率,但使智能爬虫威胁加剧。南洋理工等团队研发的WebCloak,混淆网页结构与语义,打破爬虫技术依赖,为数据安全筑防线,适用于数据敏感场景。