「对话式交互界面」共找到 1207 篇相关文章
给AI全局记忆
作者认同OpenAI‘全局记忆’观点,称其能提升对话连贯性,实现AI成个人助理愿景。介绍OpenMemory项目可存储调用记忆,还提及实现功能的三点做法,看好创业者在该领域机会。
「神经软件」正在到来,人类代码将失去意义!
Lambda Labs CEO Stephen Balaban 在英伟达 GTC 2025 提出神经软件概念,指不再写代码,让大语言模型成软件。它没传统软件的 bug 问题,未来计算机或端到端神经化,虽有争议,但变革在加速。
豆包可以跟你打视频了,陪我看《甄嬛传》还挺懂!难倒一众AI的“看时钟”也没难倒它
国产AI豆包发布视频通话新功能,能实时报准时钟时间,还接入联网搜索,准确性和时效性强。实测中,它可当看剧搭子,还能识别食材、解答物理题等,背后是豆包·视觉理解模型在发力。
谷歌偷偷上线免费Cursor,程序员饭碗又摔碎了!
Google AI Studio增加build按钮,相当于免费的cursor。能用一句话、图或文件生成完整AI应用并一键部署。可通过对话修改应用,分享应用消耗他人免费配额,利于推广Gemini生态。
刚刚,Anthropic公布Fable 5.1保姆级使用技巧,看完少走十天弯路
Claude Fable 5.1虽可兼容旧版提示词,但行为习惯有变化。官方整理提示词与工程落地指南,涵盖思考程度、工具调用进度汇报、独立工具批量调用等多方面使用技巧和避坑细节。
11篇顶会论文之外,美图影像研究院做了一件事:让大众爱用AI
过去两年,AI 生成图片、视频变得容易,但让 AI 理解并按创作者意图创作很难。美图影像研究院过去几年围绕高频创作场景痛点展开研究,11 篇论文被国际顶会接收,成果通过产品落地转化为 AI 影像能力。
刚刚,马斯克终极大招Grok Bot来了!
SpaceXAI发布Grok Bot早期测试版及将发布4.6版本。它是云原生AI Agent,能24小时工作、多Bot并行协作,还能跟班学习。它是600亿收购Cursor的成果,对标Anthropic的Claude Cowork。
看傻了!5k Star Canvas Editor,我被惊到啦~~~~
Canvas Editor是基于HTML `<canvas>` API的文档编辑器,自己控制绘制、分页、交互和导出。文章介绍其与普通编辑器差异、核心能力、适用场景、接入代码,也指出项目限制,认为它是架构新选择。
SIGCOMM 2026 | 从「人眼看视频」到「AI理解视频」:北大提出面向AI的实时通信框架Artic
AI 正从「文字聊天」走向「边看边聊」,传统实时视频通信难以满足需求。北大团队提出 Artic 框架,重构码率自适应等,实验显示其能显著提升准确率、降低延迟。
谷歌把电脑操作能力塞进Gemini 3.5 Flash!自己看屏幕狂点70轮
谷歌将电脑操作能力Computer Use内置进Gemini 3.5 Flash,该AI能通过看屏幕操作电脑,可执行点击、打字等动作。其覆盖网页、桌面软件和移动端,还加入安全约束机制,在基准测试中表现良好。