「生成式任务」共找到 4169 篇相关文章
“AI版LeCun”自己讲解论文,自我进化智能体框架生成精美演讲视频
加州大学研究者提出自我进化的学术演讲智能体框架EvoPresent,它由四个智能体协作,核心美学模型PresAesth模拟人类审美判断。团队构建评测体系,实验显示其在内容与视觉设计上提升显著,让AI兼顾逻辑与美感。
首创双NPU架构一鸣惊人!联发科天玑9500重磅加码主动式AI体验
联发科天玑9500首创超性能+超能效双NPU架构,让AI始终在线,融入用户操作。其输出性能、上下文窗口等有显著提升,还解决了模型加载慢等问题,与多厂商合作推动端侧AI落地。
实测可灵AI的新视频模型,它生成的动作戏酷到封神。
作者实测可灵2.5新视频模型,它已灰度内测并登上釜山电影节。与可灵2.1对比,可灵2.5在运动和表演能力上大幅提升,还增强了文生视频与理解能力,让创作者有更多创作自由。
Temporal:Nvidia、OpenAI 都在用,为什么 Agent 还需要专门的长程任务工具?
本文编译了 Temporal CTO Maxim Fateev 的访谈。Temporal 提出 durable execution,确保工作流可靠执行,即使出错也能继续。它获 1.46 亿美元 C 轮融资,Nvidia、OpenAI 是客户。不过,它也面临 AI 发展和云厂商竞争等挑战。
自然语言秒搜千级节点!阿里ComfyUI-Copilot开源:AIGC实时工作流一键生成!
在AIGC领域,ComfyUI虽强大但节点复杂。阿里团队开源ComfyUI - Copilot,通过自然语言交互增强工作流自动化,有节点搜索、工作流构建等功能,简化操作,提升效率。
Hugging Face开源顶级模型:双模式推理+128K上下文,最强3B
今天凌晨,Hugging Face开源顶级小参数模型SmolLM3,参数30亿,性能超同类。它有128k上下文窗口,支持6种语言、双推理模式。架构细节等全开放,联合创始人强烈推荐,称是3B领域SOTA。
谷歌AI Agent刚开源!多任务智能体+MCP+谷歌搜索,狂揽9000颗星
今天凌晨,谷歌在官网开源AI Agent框架Gemini CLI,将Gemini大模型融入终端。它能调用视频和图像模型,集成MCP、谷歌搜索等功能,还集成超强编码助手,刚开源就在Github超9000颗星。
氛围编程时代来了!AI生成+一键上线,Coding像拍照一样简单
YouWare是面向AI时代创作者的氛围编程平台,自研AI Agent和Sandbox技术,让非程序员也能将灵感转化为可视化网页并分享。它类似共创社区,有展示、互动、二次创作等功能,重新定义了AI Coding。
从像素空间走向数据流形:生成模型的对抗净化新范式 | TPAMI'26
深度神经网络虽应用广泛,但对对抗样本脆弱,制约可靠部署。本文介绍发表于TPAMI 2026的工作,提出基于一致性模型的对抗净化方法(CMAP),实验表明其在不同场景下鲁棒性强,为对抗防御提供新视角。
Pinecone 推出 Nexus 引擎:为 AI 智能体整合业务上下文并生成结构化数据
Pinecone Nexus 全面上线,是面向 AI 智能体的“知识引擎”,能将企业数据转为结构化数据层,复用数据提准确性、降成本。早期采用者在金融、法律领域看到显著性能提升,词元消耗大幅降低。