「Agent Skill」共找到 2827 篇相关文章
刚刚,Qwen3.8-Max首发上岗!「千问办公」正式开测
8月,阿里「千问办公」开启公测,它整合三款产品,还接入最新旗舰Qwen3.8 - Max。该产品交付成果可用,可一站生成多模态内容和Office产物,与钉钉打通且有组织级Skill,优势明显。
Qwen3.8-Max 正式版终于发布了,能不能打过 GPT 看这里
Qwen 3.8 Max 正式发布,沿用 Qwen 3.5 架构,参数量扩展,重点提升 Coding、Work 和 Agent 能力。它将开放权重,价格有优势。在多项测试中表现出色,还新增多模态能力,已可使用并有优惠。
阿里安全AGI一次发布3款LLM,8B多维度领先GPT-5.4
近期,阿里安全AGI实验室发布3款Yuvion LLM,在AI安全与内容安全领域多维度领先。它以‘对抗即智能’为原则,构建五类数据体系,采用三阶段训练范式,通过YLRE四级评测体系验证能力。
真·QQ飞车!「电动版F1」上海开赛,Gemini在线解说
Formula E电动方程式赛事和Gemini深度合作,Gemini承担直播解说、Driver Agent分析数据及驾驶指导功能。FE规则类似游戏,其技术或下放到普通汽车,不过自动驾驶发展下,FE未来是否需要人类存疑。
从0到1带你速通 Marvis马维斯
AI 时代,Agent 产品虽强但普通用户使用门槛高。本文详细介绍腾讯 Marvis,它能让 AI 直接理解电脑,可执行多项任务。作者实测 6 个任务展示其功能,认为它是面向普通用户的系统级 AI 管家。
DeepSeek视觉原语论文:当所有人在堆图像分辨率时,它在堆「指代精度」!
4月30日DeepSeek发布多模态论文,核心是“视觉原语”,让模型边推理边输出坐标。它是七大coding agent玩家中最后接入视觉的,但补课方式反共识,不堆分辨率堆指代精度,效率高,拓扑推理成绩领先。
分享2篇最新Harness论文,一篇谷歌,一篇微软
在LLM Agent迅速发展的当下,如何为其设计合适的Harness成关键问题。本文分享微软M⋆和谷歌AutoHarness两篇论文,分别从记忆系统和动作约束维度提出自动化的Harness进化方法,并介绍了实验结果。
罗福莉:Claude订阅封杀龙虾背后,真正的出路不是更便宜的token
Anthropic宣布Claude Pro和Max订阅用户不得将额度用于第三方Agent框架,引发各方反应。Xiaomi MiMo大模型负责人罗福莉指出,当前token计费模式难应对挑战,需更优算力使用方式,还介绍了小米MiMo Token Plan。
阿里“悟空”上线!钉钉给企业送来龙虾大军
AI钉钉2.0年度新品发布会上,阿里发布AI toB旗舰应用“悟空WuKong”,它以企业智能体为核心,能落地办公场景。悟空开启全球邀测,也会内置到钉钉AI 2.0。它还带来行业解决方案,补齐安全短板。
Seedance 2.0刷屏后,字节还有个硬核模型——3个复杂任务实测Seed 2.0
作者作为AI编程工具深度用户,没追热门的Seedance 2.0,而是实测同期发布的豆包大模型Seed 2.0。设计3个日常复杂任务,在TRAE接入其Pro版测试,展现出强大的自主纠错和多任务处理能力,也指出了不足。