「数据基础设施」共找到 2791 篇相关文章
让龙虾看懂屏幕!谷歌多模态新成果,文本图像视频音频进同一空间
谷歌发布首个原生多模态嵌入模型Gemini Embedding 2,将文本、图像、视频、音频和文档映射进同一嵌入空间,支持多模态混合输入,为AI Agent“看懂”世界提供关键基础,已展开公测。
The Batch: 982 | 法律、新闻和金融领域的定制模型
本文是DeeplearningAI《The Batch》的最新报道,汤森路透推出法律、新闻、金融领域定制大语言模型Thomson,基于Qwen构建,性能优于多款通用大模型,小版本将开源供非商业使用。
刚刚微软开源视频录制技能skill-recorder
微软开源视频录制技能 Skill Recorder,能将用户完成任务的过程转化为 AI 智能体可重复执行的技能。它捕获屏幕工作会话,用 GitHub Copilot CLI 重构操作,生成可复用内容,支持多平台。
在Claude桌面版里用任意模型
现在Claude桌面版可使用任意模型,这是4月官方更新添加开发者模式带来的功能。文中介绍了操作方法,还称Claude桌面版是世界最好的AI客户端,覆盖多种使用场景,推荐大家使用。
5000 star,Harness门槛被OpenHarness打穿了
分享开源Python实现版本OpenHarness,它易上手,能助研究者和开发者理解生产级AI Agent原理、构建专用智能体。介绍其核心功能、架构及核心循环逻辑,还给出了Github链接。
OpenAI 发布《在AI 时代保持领先》企业实战白皮书
OpenAI发布《Staying ahead in the age of AI》白皮书,用数据凸显AI发展态势,基于合作经验总结出Align、Activate、Amplify、Accelerate、Govern五个实战原则,助企业应对AI浪潮。
一个大脑,多种本体:江行智能详解物理AI工业落地的系统解法
在2026世界机器人大会具身智能商业落地论坛上,江行智能CEO庞海天演讲指出,物理AI落地受算力约束,中国工业物理AI靠工程效率。江行提出‘一脑多体’架构,产品适配多场景,真实场站成果佳。
UW天才少女官宣入职OpenAI!46场面试,地狱级求职笔记刷屏
华盛顿大学华裔女博士Alisa Liu为入职OpenAI经历57轮面试,事后公开面试准备笔记成“LLMs面试圣经”。她分享求职经验,如合理安排面试、刷题备考、每场面试专门准备、学会薪资谈判等。
Meta把内部设计系统开源了,支撑内部13000+应用,专为Agent调优
Meta开源的Astryx大更新,改造成Agent适配设计系统。它已在Meta内部演进8年,支撑13000+应用,提供150+可访问、可主题化的UI组件及开发工具,让人和AI用同一套语言。
小企业专属Claude来了!一键接入全套业务流,不用写代码AI自动算账催款
Anthropic推出Claude for Small Business,是全新连接器和工作流包,可嵌入小企业常用工具。操作简便,覆盖多领域,有安全保障,还配套培训课程和线下活动。