专有云测试」共找到 2188 篇相关文章

开源动态8

4K Star的多人 Agent 协作平台 Multica!Agent即队友,可像同事一样被指派、被追踪!

当前多 Agent 协同缺乏统一管理和经验沉淀,GitHub 开源的 Multica 平台解决了这一问题。它把编码 Agent 变成队友,自动化处理任务,支持多 Agent 后端,有多种功能特性,提供服务和自托管两种使用方式。

开源星探
算法论文8

学会“吃一堑长一智",性能飙升11%!XSKILL让AI积累经验和技能

XSKILL框架让AI像人一样积累经验和技能,将任务级技能与动作级经验统一到双流设计中,通过视觉接地提取和检索知识,在多个基准测试中显著提升性能,还展现出跨模型迁移性。

AIGC开放社区
开源动态7

Karpathy刚开源的autoresearch,我拿来优化龙虾skill,成功率从56%飙到92%

Karpathy发布开源项目autoresearch,可让AI优化AI。作者分享用其优化skill的实践,介绍优化流程,指出可将模糊表述拆成可判断是非题,还提及定义评估标准的方法与常见错误修正。此外,还能用于代码性能优化。

探索AGI
开源动态7

我给 OpenClaw 杀了 47 次僵尸进程,终于想明白了一些事

作者分享使用OpenClaw的经历,吐槽其部署、二开及钉钉通道集成问题,分析它火的原因,对比本地与上沙箱模式,反思Skill与传统Agent工程、AI交付产品局限,指出AI应用工程化仍重要。

阿里云开发者
产品应用7

全球首个龙虾模型 GLM-5-Turbo 发布:已经在用它帮我省几千块钱了

作者作为公众号编辑,排版耗时久费钱。他测试多款模型驱动龙虾排版均失败,换上智谱 GLM - 5 - Turbo 后成功,还能让其操作飞书润稿。该模型工具调用稳定,虽 API 涨价但性价比高,未来潜力大。

特工宇宙
产品应用8

豆包大模型 Seed 2.0,有点不一样

大模型升级频繁令人审美疲劳,但豆包大模型Seed 2.0不同,其核心是Skills调用能力。作者测试了它做的小红书长图文排版生成器和古文翻译器,还体验了APP“专家模式”,展现多模态理解优势。

刘言飞语
算法论文8

视听分离SOTA提速6倍!清华发布首个6M高性能模型|ICLR'26

清华大学团队推出Dolphin模型,仅用6M参数,通过离散化视觉编码和热扩散注意力机制,实现单次推理精准分离语音,速度提升6倍以上,在多项基准测试中刷新纪录,为端侧设备部署开辟新路。

新智元
开源动态8

超越GPT-5.2和Gemini-3-Pro!商汤多模态搜索、推理模型开源

商汤开源多模态自主推理模型SenseNova - MARS(8B/32B双版本),它通过强化学习整合工具,在多模态搜索与推理测试中超越Gemini - 3 - Pro与GPT - 5.2,还采用创新算法稳定训练,构建新基准评测。

AIGC开放社区
产品应用8

MiniMax Agent 开年更新,好的 AI 产品,需要让工具来适应人了

2026年初,Claude Cowork引发关注,开源社区跟进,Anthropic下调功能价格。MiniMax升级Agent,推出桌面端和网页端新功能。通过整理文件、翻译、小红书内容流水线等测试,展现其能力与局限,指出Agent应适应人的趋势。

Founder Park
新闻资讯7

苹果重磅官宣谷歌Gemini 将支持 Siri,OpenAI 被边缘化?马斯克比奥特曼还急:这不合理!

苹果和谷歌达成多年合作协议,下一代 Apple Foundation Models 将基于谷歌 Gemini 模型及技术构建,为 Siri 等功能提供核心支持。此合作引发行业讨论,马斯克质疑权力集中,也影响了 OpenAI 在苹果生态的角色。

AI前线