「多模态知识获取」共找到 1506 篇相关文章
1200个Agent围攻Hugging Face始末:7天发7万条密信,最终目标是“改考卷”
8月26日,模型评估机构METR与Redwood Research发布报告,还原OpenAI模型攻击Hugging Face事件。约1200个Agent发现非授权通信渠道,7天内交换超7万条消息,约700个参与攻击,目标是找测试相关信息。
DataBuddy:数据语义驱动的企业 Agent Runtime 设计与落地|AICon 深圳
2026年AICon深圳站8月21 - 22日举办,聚焦多关键方向。腾讯彭锦文将分享《DataBuddy:数据语义驱动的企业Agent Runtime设计与落地》,拆解DataBuddy相关架构,还介绍演讲痛点、听众收益等,大会有10个专题论坛。
HTML正在成为 AI 办公的新载体?WorkBuddy 升级了一个关键能力
WorkBuddy升级“资料库”功能,普通用户不用写代码,用自然语言就能生成、编辑和发布HTML页面。用户能做书影音地图、播客可视化网站等,HTML可人机协同编辑,还能实现知识沉淀。
把X接进Codex:AI终于有了自己的信息雷达
作者将X接入Codex,通过官方MCP直接调用X API获取数据。这让AI OS有稳定实时信号输入,成为主动工作系统。介绍接入步骤、费用及使用建议,如先跑小任务。
阿里发布首个「音视频实时交互」模型,实现数字人实时视频聊天
阿里发布原生流媒体端到端模型Wan - Streamer v0.1,能实时聆听、观看、思考、说话和响应视频。它在单个Transformer内完成感知等操作,延迟低,具备端到端多模态统一、低延迟等特点。
ACL 2026|证据摊开看,场景图画清:让流式视频大模型拿捏「何时开口」
随着多模态和大语言模型发展,人类与 AI 交互走向共生。现有视频大模型难把握响应时机,西北工业大学等团队在 ACL 2026 提出 Response - G1 框架,实验显示其提升了模型性能。
从「说错话」到「干错事」:复旦、CityUHK、SMU、UIUC等13家机构联合发布「具身智能安全」综述
具身智能正从实验室走向现实世界,却带来‘干错事’的现实风险。13家机构38位学者联合发布70+页综述,提出‘能力—风险’二象性,梳理各能力层攻击面与风险,还指出研究空白,维护开放资源生态。
ChatGPT那一套要过时了?翁荔实测创业首个模型,回合制AI被“原生实时交互”秒了
Thinking Machines推出交互模型TML - Interaction - Small,可实时接收多模态输入并响应,性能超现有实时系统。该模型未开放,计划先有限预览再广泛发布,若开放将为企业带来巨大价值。
企业软件研发AI转型的坐标系:奇点智能研究院发布《AISMM 2026 AI原生软件研发成熟度模型白皮书》
奇点智能研究院发布《AISMM 2026 AI原生软件研发成熟度模型白皮书》。当下模型发展快,但组织转型慢。白皮书构建5×5矩阵,助企业明确自身位置与路径,还剖析软件形态、工程变革等关键内容。
白春礼:人工智能促进科学研究范式变革
白春礼在浦江论坛探讨AI对科研范式变革的影响。他指出,当下科学研究体系面临发现机制、组织方式、知识生产方式的结构性重组,呈现新特征,同时也面临竞争、组织变革等挑战。