「智能体载具系统」共找到 4723 篇相关文章

开源动态8

刚刚,小红书开源了首个多模态大模型dots.vlm1,性能直追SOTA!

小红书人文智能实验室(hi lab)低调开源视觉语言模型dots.vlm1。该模型基于自研视觉编码器构建,在视觉理解和推理任务上接近SOTA水平,实测表现惊艳,还介绍了其技术架构、预训练数据布局等内容。

新智元
产品应用7

⼤模型是万能的吗?探索机器学习+⼤模型在某出海投资业务的应⽤

本文基于公共云大客户出海投资业务案例,探讨用AI大模型结合机器学习算法构建投资预算预测与分配系统。历经三版方案迭代,从纯大模型到引入机器学习算法,目前项目处于落地阶段,有望实现多方共赢。

阿里云开发者
推荐文章8

深度拆解:为什么通用 Agent 的下一站是 Agentic Browser?

文章指出 2025 年 AI 圈新风暴眼 Agentic Browser 正形成。从 Perplexity 故事讲起,阐述传统系统和浏览器限制通用 AI 发展。厘清通用 Agent、AI 搜索等概念,分析 Agentic Browser 成通用 Agent 下一站的原因,预测 OpenAI 相关产品秋季前发布。

Founder Park
开源动态8

DGM:首个可通过重写自己的代码来实现进化的AI Agent

Sakana AI发布Darwin Gödel Machine(DGM),可通过重写代码自我进化,突破了当前AI Agent智能固定的局限。它在多测试中表现出色,能力具通用性,但也有潜在风险和局限,团队已开源并提出未来研究方向。

AGI Hunt
开源动态7

谢赛宁也玩MC?开源全新世界模型生成多人一致的游戏视角

电子游戏推动AI发展,谢赛宁团队探索世界模型新方向,推出多人视频世界模型Solaris。该模型能生成多人一致的第一视角,团队还搭建了多人数据采集系统SolarisEngine,构建了多人Minecraft数据集。实验结果显示,其方法在多方面表现更优。

机器之心
算法论文8

英伟达护城河被AI攻破,字节清华CUDA Agent,让人人能搓CUDA内核

近日,字节跳动Seed团队和清华AIR的CUDA Agent引发轰动。它能编写经优化的CUDA内核,性能超torch.compile等。研究发布CUDA - Agent - Ops - 6K数据集,介绍系统管线设计、训练流程,实验结果佳,但有未对比复杂编译器等局限。

机器之心
开源动态7

智谱新模型也用DeepSeek的MLA,苹果M5就能跑

智谱AI上市后发布新成果,开源轻量级大语言模型GLM-4.7-Flash,API免费开放调用。该模型是30B总参数、3B激活参数的MoE架构,定位为“本地编程与智能体助手”,评测表现佳,采用MLA架构,多平台支持。

量子位
算法论文8

读万卷书,大模型就能「看」懂视觉世界?Meta揭秘LLM视觉先验的起源

Meta超级智能实验室与牛津团队新论文发现,只见过文本的大语言模型(LLM)能学到可迁移到视觉任务的先验能力。研究通过超100组受控实验、耗费50万GPU小时,揭开LLM视觉先验来源,还给出预训练数据配方。

机器之心
开源动态8

高阶程序,让AI从技术可行到商业可信的最后一公里

文章指出进入AI下半场,可靠性成关键。当前多种探索路径有局限,企业常用RAG、智能体框架等方案也各有问题。而高阶程序(HOP)是神经 - 符号思想的工程实践,能为AI构建可靠控制系统,已在金融等行业展现价值。

机器之心
产品应用8

文心新出的推理大模型,给了我们信心

在 WAVE SUMMIT 2025 大会上,百度发布文心大模型 X1.1,是 X1 升级版,发布即上线可免费体验。它在事实性、指令遵循、智能体等能力显著提升,全方位测评表现出色,还开源新模型,展现百度全栈 AI 实力。

机器之心