应用生成」共找到 4085 篇相关文章

开源动态8

让Skill“有图可依”:openJiuwen首发多模态Skill范式Skill-Omni

openJiuwen社区发布业界最早工程化落地的多模态Skill范式Skill-Omni,让Agent经验从‘读得懂’升级为‘看得见’。它能将网页和视频视觉知识沉淀为多模态Skill,还介绍了生成及读取方式和适用任务。

量子位
算法论文8

机器人看视频学操作!伯克利首次打通互联网视频到灵巧手真机部署链路

UC Berkeley团队提出端到端流程,跑通从网络视频生成真实灵巧手实机执行轨迹链路。解决了单目RGB视频手-物交互重建、带噪声参考轨迹动作重定向及遥操作规模化难题。还给出数据筛选要点。

新智元
新闻资讯8

这家 AI Lab 宣布所有模型无限期免费后,我顺手做了个图片版番茄钟

全球排名前十的 AI Lab,Agnes 宣布旗下核心全模态模型 API 无限期免费开放,包括文本、图片、视频。还新增百万 Token 上下文和 4K 图片生成功能。作者用其做了图片版番茄钟,官方也公开开发进度。

AGI Hunt
产品应用8

比英伟达早,比李飞飞强,大晓Kairos原生一体化世界模型定义物理AI新路线

大晓机器人发布 Kairos 开悟世界模型,其首创“多模态理解 — 生成 — 预测”原生一体化架构,采用跨具身渐进式训练体系和“以人为中心”的数据金字塔,还实现端侧部署,在四大权威具身智能基准上全面登顶。

机器之心
产品应用7

The Batch: 954 | Kimi K2.6 挑战开源权重模型领先者

Moonshot AI升级后的Kimi K2.6是1万亿参数的视觉 - 语言模型,专为代码生成设计,性能与Qwen3.6 Max Preview等相当,略逊顶级闭源模型。其功能多,幻觉率低,模型权重可免费下载。

DeeplearningAI
新闻资讯8

“我不会被 AI 吞噬”!菲尔兹奖得主、scikit-learn 守护者与全球顶尖 AI 专家巴黎共话 AI Vision | GOSIM Paris 2026

2026年5月4日,GOSIM Paris 2026 AI Vision Forum在巴黎举行。菲尔兹奖得主、scikit - learn守护者等全球顶尖AI专家共话AI。全天议程涵盖智能体AI系统、AI教育应用等四大核心议题,强调面对AI浪潮,开放才能让人类居核心。

AI科技大本营
推荐文章8

Agent 开发范式演进:从环境工程出发,“简化”多源实时上下文

本文整理自阿里云沈林在2026中国生成式AI大会分享。探讨企业级Agent落地瓶颈,指出关键在上下文供给能力,围绕信息完备性等五维度,介绍EventHouse如何让Agent接入业务环境,强调构建上下文体系重要性。

阿里云开发者
产品应用7

Agent 的第一性问题:Proactive 与 Context 经济学

过去一年AI Agent能力提升,但用户体感未同步变好,原因在于人类注意力窗口有限。赛道分化,主动式桌面Agent是新方向,AirJelly是代表产品,五源资本对其创始人黄柏特进行访谈,探讨产品设计、应用场景等问题。

五源资本 5Y Capital
产品应用7

Lyft 使用 AI 和人机协同扩展了全球范围内的本地化能力

Lyft 实现 AI 驱动的本地化系统,加速应用与网页内容翻译。新系统结合大语言模型、自动评估与人工审核,将翻译周期从数天缩至分钟级,兼顾质量与适配性,还分批量和实时翻译架构处理不同场景。

InfoQ
算法论文8

LLM 仅靠自身就能增强推理?SePT 给出简洁在线自训练范式

多数推理后训练方法依赖外部信号,SePT仅用模型自身生成的答案自训练,能提升推理能力,数学推理任务准确率升10个点。它核心简洁,设计关键是温度解耦等,不损模型通用能力,代码易迁移复现。

机器之心