图像与视频生成」共找到 2826 篇相关文章

算法论文8

Google新研究:降低大模型幻觉的全新视角——充分上下文!

谷歌新研究《SUFFICIENT CONTEXT: A NEW LENS ON RETRIEVAL AUGMENTED GENERATION SYSTEMS》提出“充分上下文”概念,剖析RAG系统失败原因并给出解决方案,对提升企业AI准确性和可靠性有重要意义。

AI工程化
开源动态8

微软发布多智能体 Web 操作系统!让 AI 成为真正“可控、协同、透明”的网页执行助手!

微软推出新一代多智能体 Web 操作系统 Magentic - UI,它能自动浏览网页、处理数据等,具备多智能体协同能力。其界面透明可控,功能丰富,安装使用友好,适用于多种复杂场景。

开源星探
推荐文章7

windsurf分享了他们对构建Agent应用的认知。

windsurf发表博客讨论Agent,指出构建Agent应用存在认知误区,分享灵魂四问分析框架评估其‘含金量’,还提到苦涩教训,提醒警惕过度设计,拥抱规模化、通用化方法。

探索AGI
新闻资讯8

Linus一句话说透Al局限:代码不能直接用,bug只能创可贴式地修

本文是 Linus Torvalds 在开源技术会议上与 Dirk Hohndel 的对话。Linus 从工程实践出发,谈到 Linux 内核开发节奏、硬件支持取舍、语言之争及 AI 应用。他认为 LLM 是工具,有价值但无法替代长期维护者经验。

InfoQ
开源动态8

开源项目 | 用自然语言做视频剪辑,人人都能用的 AI 视频剪辑工具

FireRed - OpenStoryline是开源AI视频剪辑智能体,理念是‘你说话,它剪片’。工作流程为‘理解→执行→输出’。具备智能素材搜索、文案生成等多项能力,适用于多场景,介绍了安装方式、优缺点。

小华同学ai
新闻资讯7

Codex现在随时能截屏你的桌面!OpenAI建议:开会前记得关

OpenAI为Codex新增Chronicle功能,可后台抓屏截图,生成记忆用于增强上下文。虽让工作流更丝滑,但有消耗配额、注入风险、存储未加密等问题,OpenAI建议开会前暂停。

量子位
开源动态8

刚开源仅3天狂揽4.9K star,轻量超高效版OpenClaw,10美元硬件就能跑!

OpenClaw火遍全网但硬件要求高、成本不菲。新开源的PicoClaw是其轻量替代方案,由Sipeed开发,内存占用少、启动快、成本低、便携性强,安装简单,功能多样,刚开源就成热议新星。

开源先锋
产品应用8

蚂蚁集团扩散大语言模型新突破:超800Token/s,速度与质量兼得

蚂蚁集团将LLaDA更新到2.1,通过引入“草稿 - 编辑”机制,打破扩散模型推理速度与质量的对立僵局。它有极速和质量两种模式,还采用混合训练流程及强化学习,在多基准测试中表现出色。

AIGC开放社区
开源动态7

推出 AnyLanguageModel:在 Apple 平台统一本地与远程大语言模型的 API

大语言模型是构建现代软件的重要工具,但 Apple 平台开发者集成模型困难。Hugging Face 发布 AnyLanguageModel,是 Swift 包,可替代 Apple Foundation Models 框架,支持多模型服务商,降低使用 LLM 难度。

Hugging Face
新闻资讯7

基于百万亿 Token 的 AI 使用模式分析:趋势、拐点与未来|PPT分享

近期OpenRouter报告《人工智能现状:基于OpenRouter的100万亿Token实证研究》,分析超100万亿个token的真实世界LLM交互数据,弥补LLM实际使用情况证据不足,揭示2024年转折及多方面发现。

AI大模型应用实践