「开源通用智能体」共找到 6184 篇相关文章
极佳科技朱政:世界模型会进化成 VLA 的下一代|具身先锋十人谈
具身智能领域数据难题待解,极佳科技朱政投身世界模型研究。他认为世界模型短期内是‘驯化’VLA的容器,长期或与VLA融合。其团队成果显著,还将探索多维度建模与数据配比优化。
那些让你「活人微死」的工作日,终于有救了
当前多数AI工具未打通工作流程,企业微信5.0版本却盘活内部协作、外部市场和数据资产。它有智能搜索、总结、机器人、表格等功能,还实现内部办公、内外连接、数据资产一体化,满足不同企业需求。
Genie 3,让幻觉持续成为现实
Google最新发布的Genie 3能从文本生成交互式世界,实现24fps实时交互,分钟级一致性,720p分辨率。它取长补短,有出色记忆能力,物理表现自然,还能让智能体完成任务。不过目前是有限预览,有不足。
一个模型超了DeepSeek R1、V3,参数671B,成本不到350万美元
Deep Cogito 是旧金山 AI 初创公司,开源四款混合推理模型。最大 671B MoE 模型性能超 DeepSeek v3 等,推理链比 DeepSeek R1 短 60%,训练成本不到 350 万美元。核心方法是迭代蒸馏与增强。
DeepSeek R2没来,Kimi K2来了,VLLM,SGLang首发支持
Moonshot AI发布Kimi K2大语言模型,采用混合专家架构,总参数量达1万亿。其有多项技术创新,在多个基准测试表现突出。发布两版本,用修改版MIT协议开源,vLLM、SGlang首发支持,已上线多服务。
微软发布NLWeb:把任何网站变成AI应用的秘密武器!
微软在Build 2025大会发布开源项目NLWeb,基于MCP构建,能让任何网站秒变AI应用。它是开放协议和工具集,可添加自然语言对话界面。与其他协议对比有优势,已有组织试用,不过企业采用态度不一。
AI 出图为什么总很土?2100 星开源 Skill 用 244 行给了答案
AI出图常显土气,开源项目`gc - minimal - zine - poster`用244行文档给出答案。它将日系zine感拆分为可执行指令,规定九个渲染问题,还给出取值区间和自检方法,能防止风格自我复制,且适配多种Agent。
1.4K Star!不要问答,要完成任务,一个合格的金融Agent应该是什么样?
过去一年AI Agent火热,但金融场景投研是长链路任务,有诸多硬约束。LangAlpha是Ginlix AI推出的开源金融Agent项目,能解决实际金融研究任务,有核心架构和关键能力,还给出使用方式、典型Demo及横向评测。
“如果你不用更多Token,就永远逃不出底层”:AI竞赛开始变成资源战争
文章围绕AI竞赛中资源分配问题展开,以SemiAnalysis创始人Dylan Patel经历为例,揭示Token成本疯涨、需求远超供给,介绍Anthropic模型优势,探讨具身智能成新需求点,分析竞争格局及供应链瓶颈,还预警反AI抗议。
让你的 ClaudeCode 秒变 Openclaw(龙虾),连接飞书、Discord 远程控制
作者用Vibe Coding开发Agent客户端Codepilot,将Claude Code桌面端功能拓展,支持飞书等IM远程连接等。还开源Claude-to-IM及Claude-to-IM-skill项目,前者适合开发者接入IM远程控制,后者可让Claude Code与IM远程交互。