多任务能力」共找到 7228 篇相关文章

产品应用8

锁定角色,「主体」也可控!个性化文生图,给你PS般交互体验

LayerComposer革新个性化图像生成,能让用户如在Photoshop般操控元素位置、大小,解决传统方法交互性与主体扩展难题。它有分层画布、锁定机制、模型–数据共设计三大特点,实验表现出色,未来将促进人机协同创作。

新智元
产品应用8

拆解腾讯智能体战略:自身验证,开放能力,生态放大 | 甲子光年

文章指出智能体成企业战略议题,但落地有场景复杂、知识专业和工程化挑战。腾讯云以全栈方案应对,用开发平台、行业适配和生态共建助力企业,个行业已有成功落地案例。

甲子光年
算法论文8

0.005%参数量超越SOTA!提升模型能力无需庞大奖励模型

上海交通大学等校联合团队提出轻量级奖励模型SWIFT,利用大模型隐藏状态线性特征,仅训练极小线性层,在推理任务中超越主流奖励模型,实现计算效率与准确率双提升,且在领域表现出色。

AIGC开放社区
开源动态8

智能体编排太繁琐?MASFactory用Vibe Graphing直接「话」出来了

智能体系统编排当前较为繁琐,北京邮电大学开源 MASFactory 框架,提出以图为中心架构和 Vibe Graphing 开发范式,将开发推向自然语言驱动时代,系统评估显示其效果良好。

PaperAgent
开源动态8

登顶!快手发布开源编程模型,720亿参数,创下编程能力新纪录

快手发布开源编程模型KAT-Dev-72B-Exp,在SWE-Bench Verified测试中登顶开源代码模型,与闭源GPT - 5成绩相近。该模型基于自研框架,有架构创新,还集成种软件工程能力,是构建编程智能体的有力工具。

AIGC开放社区
7

这输入法200一个月,竟还有10万人排队送钱???

Typeless是一款月订阅费超200元、功能单一却有超10万用户的AI语音键盘。它能转写语音、整理文本、AI润色,支持语言,电脑手机端均可使用。实测其转录准确、整理能力强,但润色功能有局限。

量子位
新闻资讯7

GPT-5.4意外泄露!OpenAI最新模型瞄准这2大能力突围

GPT - 5.4疑似泄露,此前在OpenAI编码助手、GitHub代码拉取请求等处有踪迹。传闻其将搭载200万Tokens上下文窗口,具备像素级精准视觉分析能力,不过也可能是炒作,网友关注其准确率。

量子位
开源动态8

无需任何 API 费用,这个Agent 拥有“看遍全网”的超能力

AI Agent 在网络信息获取上存在诸难题,而 Agent Reach 能解决这些问题。它免费开源、安全且持续更新,兼容所有 Agent,支持平台。安装简单,装好即可用,各渠道还能灵活替换。

GitHubStore
产品应用7

别再让语音机器人“答非所问”:AI Force任务型语音对话技术总结

本文围绕企业级任务型语音Agent核心挑战,提出解决“拟人化”与“专业化”问题。介绍三段式语音对话解法、架构演进,还提及‘衍算’推理框架等技术及未来方向,团队来自蚂蚁集团AI force。

阿里云开发者
开源动态8

LeRobot v0.4.0 正式发布:全面提升开源机器人的学习能力

LeRobot v0.4.0 正式发布,带来方面重大升级。有可扩展的 Datasets v3.0、新 VLA 模型、全新插件系统;支持 LIBERO 和 Meta - World 仿真;还有数据处理 Pipeline、 GPU 训练简化等特性,上线了机器人学习课程。

Hugging Face