多模态文本智能」共找到 4455 篇相关文章

产品应用8

拖拽式搭建分布式Agent工作流!Maze让非技术人员几分钟搞定复杂任务

大模型智能体落地有诸多问题,Maze分布式智能体工作流框架可提供一站式解决方案。它是集成分布式执行引擎的全能平台,有四大核心优势,还有可视化工具让非技术人员也能轻松搭建工作流。

量子位
产品应用7

AI开始学会合作?!实测4大多Agent体=10个打工人

Agent热潮进入多智能体时代,多款产品涌现。鲸哥测评了它们在商业计划、运营设计等四大场景表现,总结各产品亮点与不足,指出多Agent正推动大模型向“协作式智能群体”演进。

鲸选AI
产品应用8

谷歌Gemini Diffusion:1500 token/秒,快如闪电!

谷歌DeepMind在I/O 2025上推出实验性模型Gemini Diffusion,将扩散技术用于文本生成。它每秒能生成约1500个token,比Gemini 2.0 Flash - Lite快5倍,具备高响应速度、文本连贯性等优势。

AGI Hunt
新闻资讯7

OpenAI 将发布 Agent Builder,n8n 和 dify 危?

OpenAI DevDay 临近,提前爆料将发布 Agent Builder。其功能丰富,是完整企业级智能体编排平台。这或冲击 n8n、dify 等工具,但它们也有自身优势,DevDay 或成智能体生态分水岭。

AGI Hunt
产品应用7

阿里QwenLong-32B:1W+超长Token推理,知识密集型复杂文档高效推理

文章介绍阿里QwenLong - 32B在长文本推理的能力。长文本推理有训练效率低和优化不稳定问题,QWENLONG - L1通过强化学习等解决,还阐述其组件、训练步骤,并给出实战代码及相关链接。

CourseAI
新闻资讯7

Copilot 创始工程师:大多数 AI 编码“就像开着法拉利去买牛奶一样”

GitHub Copilot 创始工程师 Neel Sundaresan 正构建智能编码工具 IBM Bob,已有 8 万 IBM 开发者使用。他认为多数 AI 编码像开法拉利买牛奶,Bob 会按需调度模型,他还谈及智能体市场变化与风险。

AI前线
算法论文8

MIT成果登Nature正刊:90天,「AI科学家」完成3500次电化学测试

美国麻省理工学院李巨团队在Nature发表论文,展示多模态机器人平台CRESt。它结合多模态模型驱动的材料设计与高通量自动化实验,大幅提升催化剂研发速度和质量,还解决了实验结果可重复性不足问题。

新智元
开源动态8

如何定义“人味儿”?——HeartBench评测体系建设实践

在大模型竞争格局生变,情感智能评测缺失的背景下,作者团队发布聚焦AI拟人化的中文评测体系HeartBench,介绍其设计、评估方式、迭代过程等,还沉淀了评测体系构建方法论及专家标注管理思考。

阿里云开发者
算法论文8

斯坦福新论文:微调已死,自主上下文当立

斯坦福大学等机构研究人员新论文指出,依靠上下文工程,无需调整权重,模型也能变聪明。他们提出智能体上下文工程ACE,不依赖模型重训,让上下文自主进化,在多场景测试中表现优于多种方法。

量子位
产品应用8

Sora 2瑟瑟发抖!通义万相2.5放大招:一句话出1080P电影,音画精准同步

云栖大会上通义万相2.5系列模型亮相,包含四大模型,视频生成模型实现音画同步突破,降低电影级视频创作门槛。它创作能力全方位升级,支持多种模态输入,采用原生多模态架构。

新智元