「AI内容新规」共找到 11468 篇相关文章
刚刚,全球AI生图新王诞生!腾讯混元图像3.0登顶了
LMArena竞技场发布文生图榜单,腾讯混元图像3.0夺冠,超越谷歌、字节和OpenAI等模型。它是原生多模态模型,语义理解强,核心技术独特,经多阶段训练,效果能与顶尖模型媲美。
阿里开源DeepResearch模型,超强“AI研究员”,开启自主智能体新纪元
阿里巴巴通义实验室开源Tongyi DeepResearch模型,是全球首个性能能与OpenAI DeepResearch较量且全开源的Web Agent。它采用先进架构,有两套推理范式,训练方法论有创新,实测表现佳,应用场景广,用Apache - 2.0许可证。
AI Agent的上下文工程:构建Manus的经验教训
上下文工程是AI智能体的“系统一”,决定其速度、恢复力与扩展边界。Manus通过试错与用户验证,给出可复用经验,如利用大模型“上下文学习”能力、关注KV - cache命中率等。
想要「版本」超车,Agent 需要怎样的「Environment」?
AI创企you.com完成1亿美元C轮融资并转型为AI Infra公司。伴随Agentic AI发展,人工智能重心转变,人们开始思考开发适用于现代智能应用的「Agent Environment」及相应AI Infra。
Qwen2.5VL新玩法,看电影讲故事
本公众号关注AI前沿技术,分享实战案例与课程。介绍视觉叙事技术及挑战,基于Qwen2.5 - VL 7B模型微调Qwen Storyteller,构建StoryReasoning数据集,还给出实战代码及相关链接。
AI时代:判断力为何比技术能力更重要?
音乐家布莱恩·伊诺1995年指出计算机音序器把技术问题转为判断问题,如今AI时代这一洞察更凸显价值。技术壁垒消失,判断力成关键差异,未来职业将向战略判断转变。
Anthropic再次挑衅AI输出范式, 谁才是标准?
Anthropic Claude Code团队工程师称HTML应成大模型输出新标准。文章探讨使用场景,如考虑为多看一眼付多少token、内容用途、交流对象等,建议按需选格式,HTML是可视化加班费。
SubAgent 与 Skills:AI Agent 的两种扩展方式
文章介绍了 AI Agent 的两种扩展方式:Skills 是“操作手册”,让 Agent 按需获取知识;SubAgent 是独立“专家助手”,有自己的上下文窗口。还通过给文章配图案例对比两者差异,并给出使用建议。
2w star,网页秒变 AI 助手,厉害了!
阿里项目`PageAgent`登上Github热榜,是纯前端JavaScript GUI智能体框架。它让网页拥有AI Agent,通过自然语言控制界面,无需截图、OCR和多模态大模型,有多种功能特性,使用简单。
谷歌 agent-skills 根治 6 大 AI 编码通病
Chrome团队的Addy Osmani将Google的senior流程写入agent - skills,用24个Markdown文件针对AI编码时Agent常犯的6大错误,写死补救流程,提升Agent编码质量。