零数据训练」共找到 4162 篇相关文章

新闻资讯8

让龙虾看懂屏幕!谷歌多模态新成果,文本图像视频音频进同一空间

谷歌发布首个原生多模态嵌入模型Gemini Embedding 2,将文本、图像、视频、音频和文档映射进同一嵌入空间,支持多模态混合输入,为AI Agent“看懂”世界提供关键基础,已展开公测。

量子位
新闻资讯8

刚刚!AI 圈顶流 Karpathy 三连击:开源、泼冷水、AI 教育~

10月,AI圈顶流Andrej Karpathy有三连动作:开源nanochat项目,100美元可复刻ChatGPT;发表AGI十年论,给行业泼冷水;推进Eureka教育项目,重构AI教育范式。

PaperAgent
算法论文7

SceneWeaver:面向通用三维环境生成的反思型智能体框架

室内场景合成在具身智能兴起下愈发重要,现有方法存在局限。BIGAI提出SceneWeaver框架,通过基于工具的迭代优化统一多样场景合成范式,具有高保真模拟、强健物理交互等优势。

带你学AI
产品应用8

陶哲轩DeepMind梦幻联动,最强通用科学Agent来了!一口气解决芯片设计、矩阵乘法和300年几何难题

谷歌DeepMind与陶哲轩等打造的AlphaEvolve是LLM驱动的进化编码Agent。它能优化计算生态、调度数据中心等,还解决了数学难题,已在谷歌内部使用,现开启早期邀测试用。

量子位
新闻资讯8

The Batch: 982 | 法律、新闻和金融领域的定制模型

本文是DeeplearningAI《The Batch》的最新报道,汤森路透推出法律、新闻、金融领域定制大语言模型Thomson,基于Qwen构建,性能优于多款通用大模型,小版本将开源供非商业使用。

DeeplearningAI
开源动态7

刚刚微软开源视频录制技能skill-recorder

微软开源视频录制技能 Skill Recorder,能将用户完成任务的过程转化为 AI 智能体可重复执行的技能。它捕获屏幕工作会话,用 GitHub Copilot CLI 重构操作,生成可复用内容,支持多平台。

GitHubStore
推荐文章8

OpenAI 发布《在AI 时代保持领先》企业实战白皮书

OpenAI发布《Staying ahead in the age of AI》白皮书,用数据凸显AI发展态势,基于合作经验总结出Align、Activate、Amplify、Accelerate、Govern五个实战原则,助企业应对AI浪潮。

AGI Hunt
产品应用8

一个大脑,多种本体:江行智能详解物理AI工业落地的系统解法

在2026世界机器人大会具身智能商业落地论坛上,江行智能CEO庞海天演讲指出,物理AI落地受算力约束,中国工业物理AI靠工程效率。江行提出‘一脑多体’架构,产品适配多场景,真实场站成果佳。

机器之心
开源动态7

别再被昂贵 SEO 订阅费拿捏了:3.5k Star OpenSEO,直接做 Semrush/Ahrefs 开源替代

OpenSEO在GitHub约3.2k Star,想做开源版SEO工具箱,替代Semrush和Ahrefs。它把多项SEO工作流收进工具,通过MCP暴露给Agent,适合三类人,并非万能,是更开放的工具底座。

小华同学ai
产品应用7

小企业专属Claude来了!一键接入全套业务流,不用写代码AI自动算账催款

Anthropic推出Claude for Small Business,是全新连接器和工作流包,可嵌入小企业常用工具。操作简便,覆盖多领域,有安全保障,还配套培训课程和线下活动。

AI寒武纪