设计智能体平台」共找到 5406 篇相关文章

产品应用7

我做了个 Skill:让 AI 帮你生成 Logo 和图标

作者因用 Gemini 为 CodePilot 生成 Logo 获关注,开发了 Logo Generator Skill。该 Skill 可三步生成 Logo 与高级展示图,还介绍了不直接用 AI 画 Logo 的原因、使用场景、开源地址与安装方式。

歸藏的AI工具箱
开源动态7

Claude Code 能写十万行代码,读一篇公众号就废了

Claude Code 读链接能力弱,qiaomu - markdown - proxy 这个 Claude Code Skill 可解决。它按 URL 类型走不同通道抓内容转 Markdown,全程免费,安装简单,解决了 Claude Code 系统性短板。

CourseAI
新闻资讯7

用得越多、失业越快?GitHub 大改 Copilot 规则:默认拿个人代码训练 AI,还搬出 Anthropic 挡枪!

当地时间3月26日,GitHub宣布自4月24日起,Copilot Free、Pro和Pro+用户交互数据默认用于训练AI模型,Business和Enterprise用户除外。GitHub称需更多数据覆盖编码场景,但此举遭用户吐槽。

AI前线
新闻资讯7

用得越多、失业越快?GitHub 大改 Copilot 规则:默认拿个人代码训练 AI,还搬出 Anthropic 挡枪!

当地时间3月26日,GitHub宣布自4月24日起,Copilot Free、Pro和Pro+用户交互数据默认用于训练改进AI模型,但用户可手动退出。它称此举因模型需更多数据,还拿微软等挡枪,却遭开发者吐槽。

InfoQ
算法论文8

打破视频推理「先看后想」惯性,实现真正的「边看边想」丨CVPR'26

现有大型视觉语言模型(VLM)在实时场景表现不佳,宁波东方理工大学沈晓宇团队提出TaYS,让VLM从“帧文交错”切换到“并行”,实现“边看边想”,在准确性和延迟上表现出色,推动VLM走向更真实应用。

量子位
新闻资讯7

让记忆学会“进化”:探索 LLM Agent 的运行时价值感知与自适应检索 | 直播预约

本次直播将介绍最新研究成果 MemRL,提出作用于情景记忆的运行时强化学习方法,使 LLM Agent 能判断记忆价值,检索高价值经验,提升复杂未知环境下泛化性能与任务成功率。

深度学习自然语言处理
新闻资讯7

2026年AAAI Fellow名单出炉!清华校友田奇等4位华人学者入选

2026年AAAI Fellow名单出炉,12位学者当选,含4位华人,分别是南洋理工大学的Bo An、香港中文大学的Irwin King、南加州大学的Yan Liu和光明实验室的Qi Tian。AAAI将在会议期间的颁奖典礼上表彰他们。

新智元
开源动态8

图像分层生成:新加坡国立大学和Lowart AI实现了图像可编辑的PSD文件输出

新加坡国立大学和Lowart AI发布OmniPSD,利用Diffusion Transformer架构解决分层图像生成与拆解难题,实现可编辑PSD文件输出。它能通过文本生成分层PSD文件,也能拆解单张平面图像,解决AI生成图像难编辑痛点。

AIGC开放社区
8

OCR 创新技术解析丨AI Insight Talk 直播预告

在数字经济下,传统 OCR 技术面临诸多挑战。12 月 4 日 20 点,AI Insight OCR 专场直播将剖析三项突破性 OCR 技术方案,还会有圆桌对谈。分享嘉宾将介绍 HunyuanOCR、PaddleOCR - VL、MinerU 等模型亮点。

OpenMMLab
新闻资讯8

逛完世界机器人大会,我们发现了四大趋势|甲子光年

2025世界机器人大会8月8日在北京开幕,有200余家企业参展。甲子光年总结四大趋势,如激光雷达厂商入局、人形机器人进厂、VLA模型异军突起、仿生机器人走入现实,预示机器人产业走向实战。

甲子光年