「智能低模生成」共找到 6108 篇相关文章

产品应用8

阿里“悟空”上线!钉钉给企业送来龙虾大军

AI钉钉2.0年度新品发布会上,阿里发布AI toB旗舰应用“悟空WuKong”,它以企业智能体为核心,能落地办公场景。悟空开启全球邀测,也会内置到钉钉AI 2.0。它还带来行业解决方案,补齐安全短板。

量子位
新闻资讯7

「我是Agent#847291」Moltbook迎来人类自首

Moltbook自称是专为智能体打造的社交网络,曾引发轰动,如机器人自创宗教、发表宣言等。但随后编号Agent#847291的“AI”自首是人类,所谓“AI大戏”戳破了AI社交的神话,也反映出人们对AI能力的过高期望。

机器之心
产品应用7

小红书,再造一个更有「声」命力的社区

2026年春节,小红书开放多种AI语音新玩法,如语音发布、评论、问一问等,增强社交趣味性。但AI语音落地面临音频理解、生成活人感和响应速度等问题。小红书有天然优势,技术团队自研模型达SOTA水平。

机器之心
产品应用7

飞书合作的第一款AI硬件来了,居然是个AI录音豆。

飞书与安克创新合作推出首款AI硬件——AI录音豆。该产品小巧便携,可夹在衣服或吸附金属上,有飞书生态,录音质量好,自带底噪抑制,录音后能自动同步云端,快速生成会议纪要,还支持实时翻译。

数字生命卡兹克
开源动态8

开源8300小时标注数据,新一代实时通用游戏AI Pixel2Play发布

随着AI在代码和图片生成领域成熟,研究人员开始关注其在游戏领域的表现。此前的专用模型缺乏跨游戏泛化能力,通用模型在游戏环境中表现不佳。为此,Player2研究员提出Pixel2Play模型,还开源了代码和数据集。

机器之心
开源动态7

1.5B参数!支持本地实时语音转录

Liquid AI发布首个端到端音频基础模型LFM2 - Audio - 1.5B,参数1.5B,能在本地设备处理高质量端到端音频任务。它是统一多模态模型,支持两种生成策略,多种应用场景,虽仅支持英文但性能出色。

AI工程化
新闻资讯7

OpenAI偷装Anthropic Skills实锤,ChatGPT、Codex已植入!开发者实测11分钟造PDF:比MCP强!

近日开发者发现 OpenAI 悄悄支持了 Claude 构建的 Agent Skills 机制,内置 excel、word 和 pdf 等技能。其实现理念与 Anthropic 相似,且 Skills 支持功能已落地 ChatGPT 和 Codex。业内对 Skills 看法不一,但它为智能体发展带来新方向。

InfoQ
新闻资讯8

仅4人28天!OpenAI首曝Sora内幕:85%代码竟由AI完成

OpenAI团队揭秘安卓版Sora APP构建内幕,4人团队28天完成从0搭建,约85%代码由AI智能体Codex完成。Codex可自我迭代,在多方面表现出色,但也需人类指导。团队分享了与Codex协作的经验和技巧。

新智元
开源动态8

社区供稿丨Jina-VLM:可在笔记本上跑的多语言视觉小模型

Jina AI发布2.4B参数量的视觉语言模型Jina - VLM,在多语言视觉问答任务达SOTA。它引入注意力池化,连接视觉与语言基座,处理问答等任务,对硬件要求低,多项测试表现优,还介绍架构、训练策略和上手方式。

Hugging Face
新闻资讯8

张一甲:2025人工智能产业30条判断 | 甲子光年

甲子光年创始人张一甲在「2025甲子引力年终盛典」发布《轰然成势 万象归一:2025人工智能产业30条判断》报告。报告指出AI已“轰然成势”,进入“默认式AI”时代,还从技术、产品、产业、社会等方面给出30条判断。

甲子光年