「可预测并行架构」共找到 2426 篇相关文章
阿里Qwen3.5小模型发布:0.8B参数就能处理视频,边缘AI时代真的来了
阿里通义千问发布Qwen3.5系列四款小模型,采用Gated DeltaNet混合注意力机制。有原生多模态设计,解决“内存墙”问题。在多基准测试中表现出色,开发者反响好,但也存在幻觉级联、调试局限等问题。
捅破具身智能天花板!极佳视界新VLA大模型登场,复杂长时程任务近100%成功率
极佳视界推出GigaBrain-0.5M*VLA大模型,以世界模型条件驱动,引入人在回路持续学习机制。在与主流方法对比中,任务成功率提升30%,长时程任务近100%成功,还具备高效准确的价值预测能力。
OCR又出宠OpenDoc,速度超MinerU6倍
复旦开源的OpenOCR是面向通用OCR任务的开源平台,其OpenDoc是超轻量文档解析系统。它采用Pipeline模式,两阶段解析不易放大误差。UniRec - 0.1B有独特架构与分层监督训练等创新技术。
马斯克首席AI脑与莱姆病抗争!曾师从丘成桐,杨格宣布辞职
马斯克xAI核心架构师、联创之一杨格宣布离职,转任非正式顾问。他长期与莱姆病斗争,打算康复后复出。杨格是数学天才,师从丘成桐,是Tensor Programs理论之父,其技术为xAI节省大量算力成本。
小模型也能精确计算:WorldModel-Qwen的推理时代码执行实验
开发者bigattichouse让Qwen - 0.6B小模型推理时生成并执行WASM代码获计算结果。最初尝试加标签生成Python代码效率低,后用WASM,创建三层架构。虽结果未完美,但接近,还通过Gemini审查验证。
Agent 2.0时代来了,首批「工业级智能体」正在核心位置上岗
近日科技圈感叹AI工具提升效率,谷歌工程师分享使用智能体经历。1月7日阿里云百炼全面升级,开启智能体‘工业化流水线’时代,解决技术落地问题,发布企业版,推动人机协同时代到来。
直击CES:黄仁勋演讲后4个小时,苏姿丰带着她的“复仇者联盟”上台了|甲子光年
CES 2026上,英伟达CEO黄仁勋演讲后约4小时,AMD董事长苏姿丰登场,展示全栈AI战略。发布Helios架构、新GPU产品及Ryzen AI平台等,走系统工程与长期演进路线,欲抢AI基础设施市场。
老黄All in物理AI!最新GPU性能5倍提升,还砸掉了智驾门槛
英伟达CEO黄仁勋在CES 2026发布AI新品,全力搞AI。推出下一代Rubin架构GPU,性能大幅提升;发布五大领域成果,含新模型家族、平台等;还开源训练框架与多模态数据集,国产开源模型被提及。
个人电脑也能进行智能体RL训练?尤佳轩团队开源OpenTinker
伊利诺伊大学厄巴纳 - 香槟分校尤佳轩团队开源OpenTinker,这是全新‘强化学习即服务’系统。它通过解耦架构和友好API,让开发者在不同算力设备启动智能体训练,解决传统RL框架难题,指明下一代智能体基建方向。
生态为基,关系为王:AI Agent下半场的竞争法则|甲子引力
12月3日,2025甲子引力年终盛典上,嘉宾围绕《我们与AI Agent的关系》探讨。指出AI Agent竞争从技术转向生态与关系构建,还分享产品亮点、探讨技术协作等问题,并预测未来C端AI Agent核心壁垒。