GLM-4.1V-9B-Thinking」共找到 3098 篇相关文章

开源动态8

用多模态LLM超越YOLOv3!强化学习突破多模态感知极限|开源

华中科技大学、北京邮电大学等多所高校研究团队共同推出纯多模态开源LLM——Perception-R1,该模型用强化学习优化视觉感知,目前论文和代码均已开源,其在视觉任务上表现出色,为后续研究提供强大baseline。

量子位
产品应用7

OpenClaw一战封神,给大家分享6种官方不会告诉你的神级技巧。

作者分享OpenClaw深度使用体验与6种实用技巧,如本地文件管理、个人知识库管理等,对比多模型后选Claude Opus 4.5为主力,还提及适配Mac及后续计划。

数字生命卡兹克
开源动态8

让AI自动构建AI模型:UCSD 推出 AIBuildAI 智能体,斩获OpenAI MLE-Bench榜单第一

近日,加州大学圣地亚哥分校研究团队开发 AIBuildAI 智能体,可全自动构建 AI 模型。它在 OpenAI MLE - Bench 基准测试 75 个任务上以 63.1% 获奖率居榜首,实现端到端自动化。

机器之心
新闻资讯7

林俊旸果然创业了!一个“Qwen负责人”头衔值135亿

前阿里千问大模型负责人林俊旸离职后创业,种子轮目标估值20亿美元。他曾深度参与阿里多个大模型项目,离职首篇长文提出“Agentic Thinking”,或为创业方向。

量子位
新闻资讯7

Cloudflare 如何将 Quicksilver 迁移到多级缓存并处理数十亿个请求

Cloudflare 工程团队分享将全局键值存储 Quicksilver 过渡到分层缓存架构的故事。从 V1 到 V2 迁移,采用多级缓存策略,解决存储、一致性等问题,提升性能,多数请求可在短时间内响应。

InfoQ
新闻资讯8

百度搜索 10 年来最大改版,支持超千字长文本输入和 MCP 调用

7月2日,百度搜索宣布十年来最大改版,搜索框变“智能框”,支持超千字输入,集成AI写作等功能。“百看”功能、AI助手升级,接入视频生成模型MuseSteamer,还接入1.8万+MCP,提升搜索体验。

InfoQ
新闻资讯7

DeepSeek 推出快速模式和专家模式

DeepSeek web 端灰度测试快速模式和专家模式,快速模式用于日常会话,专家模式适合复杂任务,但不支持文件上传,上下文仅 128k。目前两模式能力与 v3.2 没差别,或为 v4 做准备。

AI寒武纪
产品应用7

18 岁创业者用 OpenClaw 管 16 个 AI Agent,一个人的 Agent 公司怎么运转

18岁无编程背景创业者用OpenClaw搭建多Agent协作平台,16个Agent分工明确,配合Claude、GLM等工具提升生产力。他分享工作流搭建、成本、模型选择等经验,还谈了对OpenClaw发展的看法。

InfoQ
算法论文8

DeepSeek又又又又发新论文了!这一次,他们重构了AI看图的方式

DeepSeek发布论文DeepSeek - OCR 2,指出传统AI看图方式有误,提出视觉因果流概念。其两阶段级联推理解法效果显著,还可能整合进即将发布的DeepSeek V4,有望实现原生多模态。

花叔
新闻资讯7

谷歌月Tokens消耗量领跑全球了:1300000000000000(别数了是千万亿)

谷歌月处理Tokens用量达1.3千万亿,较一年前的9.7万亿大幅增长。横向对比,谷歌在该指标上远超微软等大厂。Tokens消耗量可衡量模型多方面能力,谷歌为行业树立新标杆。

量子位