端到端」共找到 2307 篇相关文章

产品应用8

智谱清言微服务架构转型实践——基于 CloudWeGo 的技术演进

本文由智谱清言资深后开发工程师肖文彬整理,阐述其从单体架构微服务体系的转型实践。随着业务发展,传统单体架构显瓶颈,智谱清言开启转型,分享挑战、架构设计、技术选型等经验,为相关团队提供借鉴。

InfoQ
新闻资讯7

Qwen 3-235B Aider编程能力击败Claude3.7,成本便宜百倍

Qwen3-235B-A22B在Aider多语言编码基准初步测试中击败Sonnet 3.7 Thinking和OpenAI o1,成本便宜150600倍。Qwen3-32B准确率超GPT-4.5和GPT-4o ,代码编辑格式正确率达100%。

AI寒武纪
开源动态8

视频生成比播放还快:开源VDN-H3,14秒视频11秒搞定

近期,网络出现“无限流”视频,源于MiniMax H3。OpenVDN团队开源Video Delta Net(VDN),基于MiniMax H3使视频生成速度提升7590倍,14.4秒的768p视频11.23秒就能生成。它采用混合思路,性能提升显著。

AI工程化
产品应用7

OpenCode AI编程实践:利用推理路由低成本开发游戏

文章介绍用 OpenCode 结合 DigitalOcean 推理路由器开发点球大战游戏 PK Shootout。其按任务选模型,多数任务路由 MiMo V2.5 和 GLM - 5.2,成本约 8.25 美元,远低于只用前沿模型。文中还分析开发各环节及适用场景。

AI工程化
产品应用7

Claude Opus 5深夜发布,以一半价格逼近Fable 5。

周六凌晨Claude Opus 5全量上线,在所有Claude产品里可用。它有100万上下文,知识最新2026年5月。跑分显示其在很多领域逼近Fable 5,价格仅为一半。它和Fable 5各有优势,还带来Claude Code使用的变化。

数字生命卡兹克
推荐文章8

模型之上,才是真正的资产

微软CEO萨蒂亚·纳德拉在《没有生态的前沿,立不住》中提出,每家公司未来要构建人力资本与Token资本。强调Token资本构建靠学习闭环,还提出检验公司是否拥有Token资本的方法,呼吁避免价值集中少数模型公司。

五源资本 5Y Capital
新闻资讯7

deepseek v4.1? 梁圣的午礼物突袭。

群里小伙伴称deepseek官方灰度新模型,手机和webFlash模型思考模式大变,典型bug修复。测试发现幻觉严重,知识库截止大概25年6月。同时,deepseek获500亿首轮融资,梁文锋自掏200亿,投资方无投票权,五年锁定期。

探索AGI
开源动态8

别再给AI送钱:10款开源工具省80%Claude Code Token,大项目直接砍49倍

使用Claude Code等AI编码工具常遇额度用完、账单超预期问题,80%钱浪费在冗余输出等。社区博主整理10款开源工具,适配主流AI编码工具,最高能将大项目Token消耗砍1/49,还介绍省Token习惯及互助项目。

AI工程化
算法论文8

GRPO遭遇瓶颈?G²RPO-A让自适应指导为小模型推理能力「开外挂」

大模型推理能力难迁移小模型,现有强化学习方法如GRPO在小模型上性能提升有限。香港中文大学(深圳)唐晓莹教授团队提出G²RPO - A算法,缓解小模型奖励稀疏问题,在多模型实验中表现优于vanilla GRPO。

机器之心
新闻资讯8

黄仁勋 × Lex Fridman:NVIDIA 4 万亿市值背后的 AI 革命

黄仁勋与Lex Fridman进行两小时访谈,从Amdahl定律聊人类意识。谈及NVIDIA发展,如CUDA决策致市值下跌后回升;提出AI扩展定律,认为智能由算力决定;还分享管理、技术预判等看法及对中国创新的评价。

宝玉AI