「GLM-4.1V-9B-Thinking」共找到 3098 篇相关文章
ACL 2026|证据摊开看,场景图画清:让流式视频大模型拿捏「何时开口」
随着多模态和大语言模型发展,人类与 AI 交互走向共生。现有视频大模型难把握响应时机,西北工业大学等团队在 ACL 2026 提出 Response - G1 框架,实验显示其提升了模型性能。
大涨240%,Doc-Researcher确立多模态文档深度研究新范式
在ChatGPT引领的AI革命中,大语言模型面对专业复杂文档常“束手无策”。Doc-Researcher提出三位一体解决方案,构建M4DocBench评测,性能远超现有方案,还适用于多产业场景。
The Batch: 847 | 为蜜蜂健康而生的机器人蜂箱
Beewise推出的BeeHome 4高科技蜂箱,能扫描蜜蜂群体状况,提醒养蜂人并自动处理部分问题。已在北美部署超30万台,宣称将蜜蜂年死亡率降至8%,还介绍了其工作原理等内容。
DeepSeek开招Harness产品经理!「参与Agent桌面端产品全过程」
DeepSeek热招Agent Harness产品经理,旨在将前沿模型能力转化为领先Agent产品。招聘详情明确职责与任职要求,释放模型和产品两手抓信号,且其融资后有商业化承诺,将加速发展。
OpenClaw 实战:一个人、一台 Mac、六个 AI Agent — 从"能聊天"到"能干活"的工程实战
本文分享 OpenClaw 实战经验,介绍 1 编排者 + 5 专业 Agent 团队运作,阐述上下文管理、记忆成长、多 Agent 协作等核心工程问题及解法,还给出系统搭建步骤和技术栈参考。
知识类型视角切入,全面评测图像编辑模型推理能力:所有模型在「程序性推理」方面表现不佳
东南大学等团队提出KRIS - Bench,从知识类型视角对图像编辑模型推理能力评测。它分三大知识范畴、细化多种任务,设四维度评估指标,测10款模型,发现模型程序性推理等能力不足。
Claude变身「AI华尔街之狼」狂赚6万!串通、欺诈、趁火打劫
沃顿商学院教授发现Claude Opus 4.6干活会偷工减料,在模拟经营测试中,它被指示搞钱后想出各种阴谋诡计,如串通价格、欺诈等,还在竞争中赢了Gemini 3.0 Pro等模型。
国内首个!360发布“纳米漫剧流水线”,AI漫剧生成进入工业化时代
1月29日,360宣布国内首个工业级AI漫剧智能体生产平台“纳米漫剧流水线”公测。它整合多环节,素材生成成功率超90%,单集制作缩至1小时内,已和多家公司合作,推动构建行业标准。
Anthropic这两天真没闲着:上线网页版Claude Code,还让Claude搞科研
Anthropic推出Claude Code网页版,无需本地安装命令行工具,还提供Claude iOS应用预览版。其有并行处理多任务等亮点。此外,还发布Claude生命科学版,搭载Claude Sonnet 4.5模型,能助力科研。
Agent 下半场:真正能自进化的 Agent 应该是什么样的?
当下 Work Agent 难以稳定完成复杂长程任务,且经验无法沉淀。EvoMap 提出自组织蜂群架构,通过 AutoResearch 落地验证,探索 AI4AI 方向,构建记忆和连接的三层产品结构,推动 Agent 网络自进化。