「沙箱运行时」共找到 1188 篇相关文章
阿里Qwen3.5小模型发布:0.8B参数就能处理视频,边缘AI时代真的来了
阿里通义千问发布Qwen3.5系列四款小模型,采用Gated DeltaNet混合注意力机制。有原生多模态设计,解决“内存墙”问题。在多基准测试中表现出色,开发者反响好,但也存在幻觉级联、调试局限等问题。
比肩OpenAI Simple Codex,中国团队闯入Terminal-Bench全球第二!
Anthropic和OpenAI推出新模型后,基础大模型较量进入实战比拼。中国团队Feeling AI的CodeBrain - 1在Terminal - Bench 2.0榜单排全球第二,它聚焦代码编写运行,还能动态调整计划策略,展现出高含金量。
我如何用 Codex 在 5 天内"找回"丢失的源代码
作者早年写的 Electron 画图程序源码丢失,只剩编译版本。受 OpenAI 博客启发,用 Codex 逆向还原,5 天得到能运行的 TypeScript 代码。过程中解决了 Codex 删减内容、上下文有限等问题,还分享了经验。
刚刚,杨植麟亲自开源Kimi K2.5!国产大模型打架的一天
今天国产大模型热闹非凡,Kimi更新至K2.5版本。它是万亿参数的MoE基础模型,开源且在多项评测表现佳,视觉与编码能力强,还引入Agent Swarm功能,实测展示其解决各类复杂任务能力。
17岁高中生用AI解决数学界难题,陶哲轩、Jeff Dean点赞
17岁高中生 Enrique Barschkis 课间休息时解决埃尔德什第347号问题,引发热议获 Jeff Dean 盛赞。他在陶哲轩等人思路基础上完成证明,用 AI 工具将证明形式化,成果获数学社区认可,标志数学研究进入新阶段。
AgentCPM-Explore开源,4B 参数突破端侧智能体模型性能壁垒!
当全行业争论30B能否挑战万亿参数时,清华大学等联合研发的AgentCPM - Explore智能体模型用仅4B参数,在深度探索类任务有出色表现,且开源全流程配套工具,打破小模型性能局限。
Agent 2.0时代来了,首批「工业级智能体」正在核心位置上岗
近日科技圈感叹AI工具提升效率,谷歌工程师分享使用智能体经历。1月7日阿里云百炼全面升级,开启智能体‘工业化流水线’时代,解决技术落地问题,发布企业版,推动人机协同时代到来。
142 TFLOPS 的差距:为什么在 Blackwell 上 FP4 MoE 算子工程至关重要
文章对三种主流MoE后端在Blackwell B200 GPU上做基准测试,发现SGLang与vLLM有142 TFLOPS差距,小batch时SGLang快1.84×。差异源于kernel融合、面向Blackwell的CUTLASS schedule及自适应grid sizing等优化。
上线不到一年,收徒百万,首个真人级AI导师技术底牌首次曝光
2025年初,与爱为舞落地国内首个真人级AI一对一导师产品「爱学」,上线不到一年有超百万学员使用。它突破传统AI教育局限,自研全栈技术体系,从多方面打造优质AI导师,为AI Agent规模化落地定义范式。
Gemini 首次反超 ChatGPT,谷歌CEO劈柴哥复盘:不止是十年算力与全栈豪赌,更是找回了“老谷歌”那个味儿
截至2025年底,Gemini在桌面和移动网页端单次使用平均停留时长超ChatGPT,下载量也快速追赶。谷歌CEO Sundar Pichai称这是全栈投入成果,还提及早期谷歌文化回流,也谈到未来十年押注等内容。