目标实现」共找到 2616 篇相关文章

新闻资讯8

DeepSeek、智谱被曝造芯,国产大模型绕开英伟达!

据路透社等爆料,DeepSeek与智谱AI正秘密自研定制化AI芯片,目标是摆脱对英伟达等的硬件依赖,构建自身算力生态。因算力账本和外部环境压力,两家公司选择研发面向推理场景的芯片。

新智元
新闻资讯7

AI把代码写崩,再花1周1万美元请人用AI修:Vibe Coding的荒诞闭环出现了

Slopfix团队由3名资深工程师组成,专门清理AI生成、难维护的代码库。先免费分析代码,适合重构就报价并承诺代码缩减目标,按完成比例收费。此模式引争议,也反映AI代码治理成新需求。

InfoQ
开源动态7

用 LLM Wiki 给自己搭一个会越用越值钱的第二大脑

这是基于Andrej Karpathy的LLM Wiki模式构建的开源项目,能方便实现第二大脑。上传资源后Claude会主动提取实体、建立概念网络,知识会‘自己生长’,用得越久边际价值越高。还介绍了安装及使用方法。

AI进修生
推荐文章7

当 Token 成为商品,AI 基础设施会怎么变化?

在大模型时代,智能生产和交付未实现工业化,存在性能鸿沟。九章云极提出AI工厂战略,发布Alaya NeW Cloud 3.0,将从资源计量转向智能计量,打造训练和Token工厂,提升算力到有效Token的转化效率。

InfoQ
产品应用8

阿里云发布Qwen Cloud,加速AI出海!

阿里云在新加坡面向海外发布Qwen Cloud、Agent产品MuleRun等一系列产品及更新,实现云基础设施升级。Qwen Cloud是全新AI产品官网,Qwen3.7 - Max位列全球第五,Qoder用户超500万,阿里云基础设施迈入Agentic Cloud。

阿里云开发者
推荐文章8

万字长谈丨同济工智院华先胜:工程智能,是 AI 的「成人礼」

雷峰网·AI科技评论对话同济工智院华先胜,探讨工程智能。他认为工程智能是AI与工程深度融合,要从数字走向物理世界,构建体系,实现人机共生,还介绍了研究院成果、灵感计算及操作系统架构等。

AI科技评论
开源动态8

小钢炮开源,一张3090两小时「从零训练0.1B全模态模型」,模型训练彻底平民化

MiniMind - O是开源超轻量级端到端全模态大模型,采用双轨架构。仅需一张RTX 3090,2小时就能从零训练全链路。有两套训练数据,具备零样本声音克隆等特点,实现大模型训练平民化。

开源AI项目落地
新闻资讯8

LLM近期重大架构进化一览:从Gemma 4到DeepSeek V4

近期大模型长上下文需求增长,成本问题凸显。Google Gemma 4、Poolside Laguna XS.2、Zyphra ZAYA1 - 8B、DeepSeek V4 等模型各有架构优化,如 Gemma 4 跨层 KV 共享和 PLE,以降低长上下文推理成本。

机器之心
开源动态8

参数砍到 1B,这个小钢炮拿下多模态第一

面壁智能发布并开源参数量仅 1.3B 的 MiniCPM-V 4.6,虽小但多模态综合能力在 1B 级别中夺冠。它推理快,效率高,靠两大架构创新实现,还为开发者提供完整工具链。

AGI Hunt
开源动态8

社区发布丨全面开源!商汤日日新SenseNova U1发布,迈向模型理解生成统一时代

商汤科技正式发布并开源商汤日日新SenseNova U1系列原生理解生成统一模型,基于NEO - unify架构,实现模态集成向原生统一跨越,其轻量版在多项测试达同量级开源SOTA,还能连续性图文创作。

Hugging Face