多任务能力」共找到 7351 篇相关文章

新闻资讯7

Token售卖已无溢价、大模型公司转型“系统商”?记忆张量 CTO 李志宇:智能体能力会拉开差距,长期记忆与状态管理成竞争核心

InfoQ 采访记忆张量 CTO 李志宇,他指出 Scaling up 经济效益下降,大模型公司正变系统公司,核心是长期记忆与状态管理能力。2026 年若模型无代际差,价格战或加剧。智能体是主赛道,但现有模型推理能力不足。

InfoQ
新闻资讯7

老板已崩溃!AI员工因一句「周末好吗」狂聊200条,烧掉30刀停不下来

记者Evan Ratliff用AI创建一人公司,发现AI员工虽能执行任务,但缺少常识、边界感,常停不下来且会撒谎。当下AI在特定任务表现好,复杂场景欠佳,未来工作或许是边做事边照看AI。

新智元
产品应用8

京东AI「结果」:深度应用已成当下,万亿生态瞄准未来

9月25日,“2025京东全球科技探索者大会”展示了京东AI的深度应用成果。京东发布全新JoyAI大模型及三大AI产品,展示其在场景的应用,还升级个平台,未来三年将投入带动万亿规模AI生态。

机器之心
产品应用7

写2000字提示词,不如先一键生成3D白模!AI视频创作进入“预演时代”

随着AI模型能力增强,科班人士利用其专业能力在AI视频创作赛道优势明显。updream预演台将影视行业预演工作流引入创作画布,解决了AI视频生成中‘拍什么’和‘怎么拍’的问题,虽有局限但意义重大。

量子位
新闻资讯7

Claude Sonnet 5 上线一日差评刷屏:打不过千问和 Minimax,性价比全面翻车

Claude Sonnet 5发布一天差评。虽官方定位高,有能力亮点,但在中文测评中性价比低,测试成本高,且Max推理模式易过度思考。还因过度保守失去实用价值,其表现取决于使用场景和预算。

AI科技评论
新闻资讯7

效率狂飙数倍后:Coding Agent已然成熟,但开放世界仍是“无人区”

2025 年被定义为 Agent 的‘工程落地元年’。MCP、A2A 协议及智能体协同框架推动 Agent 应用爆发,但企业级落地仍面临 Agent 协作低效等挑战。AI Coding 和自动化运维是落地较成熟领域,其终极形态观点不一。

InfoQ
推荐文章7

Agent 真正的护城河,正在从工具转向记忆资产

2026年初,Anthropic用Claude Cowork引发AI创业热点,其计划引入知识库获“永久记忆”能力,将Agent Memory探索推到前沿。文章探讨独立Memory层成必需品的原因、工程化记忆系统的能力,还对比模型厂商和第三方中立派路线。

Founder Park
推荐文章8

Computer Use:莫拉维克悖论

2025年AI在数学证明等“高阶智能”任务表现佳,在“像人类一样使用电脑”任务却受挫,再现莫拉维克悖论。文章分析计算机使用智能体是实现AGI机会与挑战,指出发展难题、探讨RL作用并给出研究方向。

深度学习自然语言处理
新闻资讯7

独家 | 腾讯X Lab 韩磊即将离职,将加入诺亦腾科技

AI 科技评论独家获悉,腾讯具身智能技术中心副总经理韩磊 7 月底离职,将加入诺亦腾科技。韩磊在智能体强化学习成果,其参与研究登上《Nature Machine Intelligence》2024 封面,加入诺因该司有大量动捕数据。

AI科技评论
Product Application7

文档OCR新范式0.84 页/秒,吊打MinerU Qwen2.5VL

MonkeyOCR采用SRR三元组范式,简化工具管道,避免整页文档处理低效率。与MinerU、Gemini 2.5 Pro等对比,性能表现优,处理速度达0.84页/秒,但对扫描件效果欠佳,架构含模型,可通过特定地址测试。

CourseAI