「内容创作Agent」共找到 3639 篇相关文章
CVPR2025|MCA-Ctrl:多方协同注意力控制助力AIGC时代图像精准定制化
中国科学院计算技术研究所团队提出无需微调的通用图像定制方法 MCA - Ctrl,利用扩散模型内部知识,结合条件语义与主体内容。实验显示其在编辑和生成任务表现优,解决了现有技术瓶颈。
云知声发布U2-Flash,要争“大模型主力位”|甲子光年
本文报道云知声发布U2-Flash大模型,基于原有U2基座,通过创新后训练方案提升Coding、Agent等复杂任务能力,多项评测比肩头部模型,目标成为企业真实生产任务的主力大模型。
量子位编辑作者招聘
量子位是追踪AI新进展的内容平台,现招聘AI产业、财经、产品方向编辑作者,岗位有主编、主笔、编辑。全职工作地点在北京中关村,社招、校招均有,有丰厚回报和成长机会。
拆解 Claude 5.1:38 小时不睡觉的背后,Anthropic 正在终结「模型论」
Anthropic 更新 Claude 5.1,推出 Fable 5.1 和 Mythos 5.1,将‘智力’与‘权限’物理剥离。前者负责通用任务,后者面向专业场景。此次更新展示模型解决长时任务状态一致性等问题的能力,还体现了能力权限分离等变化。
DeepSeek睁开眼了!Opus-4.8的性能,1000张图不到20美分
DeepSeek首个多模态视觉模型deepseek-v4-flash-vision-exp上线DeepSeek API平台。文本能力与V4-Flash持平,多模态Agent能力逼近Opus-4.8,分析1000张图成本不到20美分,还上线免费Files API。
开启Benchmark的Harness时代:15家学术机构联合发布HarnessEval
8月13日,DeepSeek开源Agent Harness dsh引发行业对“Harness”的关注。近日,MirroS联合多机构发布HarnessEval,将其概念引入评测系统。它使评测从Metric到Harness,形成可执行评测系统,已落地于交互式世界模型。
Claude Code没有“魔法”
资深工程师 Daisy Hollman 在演讲介绍了 Claude Code 插件设计与上下文工程原语,以及 Anthropic 内部多 Agent 工作流。指出定制模型可放大能力,上下文窗口是关键,还探讨多种插件抽象与工作流扩展方式。
开源一个非常漂亮的文章配图 Skill
作者将给文章配图的经验做成 `guizang-material-illustration` Skill 开源。它能把文章等内容变成带中文标签解释图,适配多种场景,解决配图难题,还做了多项优化,介绍了适用场景、安装使用方法。
Mimo Code 爆火:我们挖开源代码,找到小米 AI 的真创新
6月11日小米MiMo团队开源MiMo Code项目,定位终端编程Agent。它基于anomalyco/opencode,虽有创新但引发争议,有人肯定工程设计,也有人质疑fork行为和运营节奏,本文还探讨了Harness方向与开源意义。
从数学思维到AI睡眠,于大川在千亿赛道的第二次“白魔法”创业|甲子光年
于大川曾创办豌豆思维,“双减”后他“半退休”。如今他重启创业,创立豌豆智能,想用AI改善人类睡眠。该公司已获君联资本天使轮融资,于大川分享了创业思路、产品模式、团队组建等内容。