「多任务操作」共找到 5693 篇相关文章
字节跳动Seed1.5-VL复杂图表精准抽取,Deep Think是多模态未来的主流
文章介绍字节跳动的Seed1.5-VL模型,它能精准抽取复杂图表,处理模糊图片、推理几何题。其由视觉编码器和LLM组成,预训练语料丰富,后训练结合多种方法,推荐在huggingface体验。
The Batch:820 | Qwen3 向 DeepSeek-R1 发起挑战
阿里巴巴发布八个大型语言模型权重,含两个 MoE 架构和六个稠密模型。预训练数据达 36 万亿 token,支持 119 种语言及方言。测试中 Qwen3 家族表现出色,或终结 DeepSeek - R1 霸主地位,设计用于智能体系统。
2025年第二届「兴智杯」全国人工智能创新应用大赛正式启动,线上报名开启
2025年5月8日,第二届「兴智杯」全国人工智能创新应用大赛启动,由多机构主办。大赛聚焦关键能力设赛题,分主题赛和总决赛,有激励机制。深圳产业优势突出,共同主办助力人工智能融合发展。
98%财务顾问依赖AI,揭秘7家先锋企业如何解锁商业新格局
OpenAI报告剖析7家前沿公司应用AI经验。如摩根士丹利评估后让98%财务顾问用OpenAI;Indeed用GPT - 4o mini优化职位匹配;Klarna用AI客服助手提升效益等,展示AI重塑企业运营的潜力。
实战指南:从零构建 MCP 架构下的 Agentic RAG 系统,无第三方MCP Server
五一期间作者用MCP架构从零实现Agentic RAG系统,分享MCP与Agentic RAG融合思考、架构设计,介绍MCP服务端和客户端实现,还做了端到端效果演示,指出架构优势及待优化处。
人生周报v022:十层认知
文章围绕育儿量化指标、写提示词的难点、培训出路、AI生成PPT的局限、MCP协议误区等多个话题展开讨论,还推荐了物理科普书《解析物理的十层之旅》。
独家|撬开Jev黑箱,对话全球首批复现者:9B小模型跑通79毫秒“快决策”
本文独家对话APUS AI首席科学家张旭,该团队完成全球首批爆火Jev模型的功能复现,开源相关成果,实现9B小模型79毫秒单次决策,拆解Jev底层逻辑,探讨快决策模型应用前景与Agent未来分工趋势。
Jev 的「百亿补贴」迷局:既然「极省」为何还要狂送 1.2 亿 Token?
主打省Token的AI模型Jev,近日大手笔向用户发放1.2亿Token额度,本文深入分析这一反常操作背后的商业布局,拆解其抢占Agent小决策判断节点的底层逻辑。
开源仅 3 天狂揽 7.1K Star!Browser-Use 把 Jev 模型装进了浏览器 Agent!
本文介绍Browser-Use团队开源的jev-ultrafast项目,该项目将新型Jev模型整合进浏览器Agent,通过读DOM替代截图推理,大幅提速降本,开源3天收获7.1K Star,冲上Hacker News首页。
AI会做题,却未必能自进化:字节Seed等提出三项新基准
字节跳动Seed联合多家机构,针对当前递归式自我改进AI依赖外部给定目标反馈的缺陷,提出三项新基准,从三个核心维度研究Agent自进化能力,揭示了当前AI自进化的核心瓶颈。