「直播」共找到 182 篇相关文章
Clawdbot创作者Peter Steinberger首次公开亮相,讲述AI失控、被迫更名和拒绝VC的疯狂一周
Clawdbot创作者Peter Steinberger首次公开露面,在TBPN直播访谈讲述项目从诞生到失控全过程,披露被Anthropic要求更名细节,阐述对风投态度,描绘传统App将‘融化消失’的未来。
张鹏对谈李广密:Agent 的真问题与真机会,究竟藏在哪里?
本文是《今夜科技谈》直播沉淀,极客公园整理。拾象科技李广密、钟凯祺从多维度拆解 Agent 真问题与机会,探讨产品、技术路径、商业模式等,指出 Agent 发展方向与挑战。
「硬创 Conclave」邀请函丨15人闭门局,聊透消费级家庭机器人的真问题
雷峰网硬创邦与山行资本联合发起消费级家庭机器人闭门会,探讨刚需真伪、端侧算力等真问题。活动遵循不直播等原则,2026年6月25日举办,限15人,需审核报名。
刚刚,OpenAI最强DevDay剧透!奥特曼发神秘预告,Jony Ive压轴登场
OpenAI DevDay即将开幕,奥特曼发文称有新东西助力AI开发。本届大会或成其在硅谷扩张宣言,将推出Agent Builder,或发布ChatGPT浏览器,还聚焦企业级AI应用,展示新兴技术体验区。
C罗刚头球破门,AI解说脱口而出!全模态实时流太狠了
2026世界杯正热,阿里云在Flink Forward Asia 2026大会宣布Apache Flink 3.0进入Agentic Streaming For AI时代,推出全模态数据流处理能力,可让AI实时解说比赛。Flink 3.0解决了流式Agent数据处理难题,已有智能运维等应用场景。
小红书最新开源TTS力作!4人对话自然无缝,毫秒极速响应!
近年来TTS技术爆发,但多人对话的自然流畅性和长序列稳定性一直是难点。小红书团队开源的FireRedTTS - 2是面向多人对话场景的TTS模型,实现自然切换和低延迟,支持多语言,适用于多种场景。
清华深研院等开源GUAVA:单图0.1秒出3D形象,打破数字人天花板
清华深研院和国际数字经济研究院的中国团队开源GUAVA,单图0.1秒就能生成3D形象,在速度、效果和成本上远超传统数字人制作流程。它结合EHM模型和3D高斯泼溅技术,有诸多应用场景。
清华叉院教授手把手教你用强化学习训练智能体
在大模型智能体时代,智能体强化学习训练通用智能体很关键。ASearcher 是相关项目,AReaL 有交互次数和代码设计优势。本次吴翼教授将带团队成员,以多轮搜索智能体为例,教用最少代码实现训练。
AI在实时视频里秒“剪”出你想要的部分!输入文字/图/视频片段,它都能秒懂|ICCV2025
最新混合模态在线视频定位技术OVG - HQ开挂了!它能根据文字、图、视频片段等线索,在实时视频流中精准裁剪出关心的事件,已收录于ICCV2025,破局以往技术“离线”“词穷”缺陷。
实测惊艳全球的Veo3!音画同步无敌,贵是有原因的
谷歌开发者大会推出的Veo3模型,具备强大文本和图像转视频能力,首次实现视频与音频同步生成。实测中,它生成的视频音画效果惊艳,但也有翻车情况,谷歌还给出提示词编写指南。