「开源数据」共找到 4911 篇相关文章
Gemini盘活了谷歌全家桶,“原生”自带你10年的记忆
谷歌发布由Gemini3驱动的“Personal Intelligence”功能,底层连接旗下四大应用,让AI跨应用获取数据,还内置纠错机制。该功能现处Beta测试,未来覆盖免费用户。谷歌与苹果引入Gemini后路径不同,AI竞争也转向生态构建。
清华系DeepSeek时刻来了,硅谷沸腾!单卡200倍加速,视频进入秒级时代
清华大学TSAIL实验室与生数科技开源视频生成加速框架TurboDiffusion,引发全球AI社区热议。它能在几乎不影响生成质量的前提下,让视频生成速度飙升100 - 200倍,将AI视频带入实时生成时代。
兄弟们,人都麻啦,网站克隆+AI生成前端,又一个卷王项目,这叫我还怎么卷啊!!!
Open Lovable由Firecrawl团队开源,输入网站URL,AI就能将其转换为可运行的React/Next.js应用。项目亮点是开源、支持多AI提供商等,可解决原型开发、旧站迁移等痛点。
谷歌云推出面向毫秒级延迟工作负载的 Rapid Storag
在 Google Cloud Next 2025 大会上,谷歌云推出 Rapid Storage,为频繁访问数据和延迟敏感应用提供毫秒级数据访问,有低延迟、高吞吐量等特点,还与亚马逊 S3 Express 被比较,目前处于预览阶段。
关键词挖掘3步法,帮你找到用户真正想搜的词【干货】
作者白杨SEO结合ChatGPT选题,分享3步关键词挖掘法。先找种子词,可从产品、人群需求、对手入手;再拓展长尾词,用搜索引擎、工具、AI辅助;最后数据筛选,看搜索量、竞争度、商业价值。
训练即服务!让模型训练回归算法语义,150行代码跑通RL
ModelScope团队开源Twinkle框架,采用Client - Server架构,支持20余种算法组件。开发者约150行代码就能编排复杂RL训练循环,底层调度等交给框架。它兼顾易用性与灵活性,有多种特点和优势,代码已开源。
27、42、73,DeepSeek这些大模型竟都喜欢这些数!为什么?
技术作家发现GPT - 4o、Claude等模型猜数偏好42、73,Andrej Karpathy测试中模型多选27。网友猜测原因,如数据集、人类偏见等,也有论文分析此现象,多与数据分布有关。
DeepMind爆火论文:向量嵌入模型存在数学上限,Scaling laws放缓实锤?
DeepMind一篇关于向量嵌入局限性的论文在AlphaXiv爆火。其证明向量嵌入有数学上限,Scaling laws或放缓。研究构建LIMIT数据集,测试发现即便是先进嵌入模型也难解决简单任务,揭示了RAG系统约束,让人反思Scaling Laws边界。
“开源版贾维斯”一夜席卷硅谷!Mac mini因它卖爆
开源AI助理Clawdbot爆火,GitHub获超两万星。它能调用多模型,被称“开源贾维斯”。为部署它,网友疯抢Mac mini。其作者是退休亿万富翁Peter Steinberger,网友用它处理各类事务,还有挣钱挑战。
当黄仁勋将存储定义为「AI运行内存」,基础设施该如何实现物种进化?
AI算力需求使全球内存市场疯狂,黄仁勋称存储技术需重构。XSKY星辰天合发布AIMesh方案,战略转向数据智能,其方案可破传统存储架构三堵墙,还坚持中立,助力企业数据转化。