「小公司」共找到 2588 篇相关文章
深度学习中Batch Size对训练过程如何影响?
文章分析深度学习中batch size对训练过程的影响,探讨超大batch优缺点及应对方法。用面试、通俗、科学三种方式解答问题,还通过MNIST实验,从迭代速度、梯度平滑程度、收敛速度等指标对比不同batch size情况。
50年僵局打破!MIT最新证明:对于算法少量内存胜过大量时间
MIT理论计算机科学家Ryan Williams最新研究建立数学程序,将任意算法转化为占用空间更少的形式,证明少量计算内存比大量计算时间更有价值,打破计算机科学家近50年认知。
6.5k星!轻量级多智能体对话编排框架Agent Squad
Agent Squad是轻量级多智能体对话编排框架,有6.5k星。它能管理多AI代理、处理复杂对话,具智能意图分类等特性。新SupervisorAgent可协调多专业代理,还有演示应用及多种使用示例。
当AI幻觉开始操作电脑:深大、港科大提出ECA,让Agent行动前先验证证据
本文针对Agent场景下AI幻觉会转化为实际错误操作的问题,介绍深圳大学与香港科技大学提出的ECA框架,通过独立验证加门控检查降低不安全执行风险,给出测试数据验证方案有效性。
Vibe Coding杀进3D领域!OpenAI总裁都在围观这种新玩法
AI 3D 基础模型领先公司 VAST 发布 Tripo P2.0,直接产出原生四边面拓扑,解决生成后模型可用性问题。此外,VAST 完成约 30 亿融资,Tripo 系列在评测中居首。
给优秀实习生期权!刚刚,一项面向AI顶级人才的「面壁计划」启动了
面壁智能发布「前进四」顶尖人才计划,面向优秀实习生,符合条件者毕业前可提前获期权。该公司过去一年成长迅速,提前押注端侧、首创「密度定律」且坚定开源,成果丰硕。
八年研究沉淀,原方智能试图让机器拥有关于世界的「信念」
原方智能正式启动,由林浩鑫与唐开强创立,技术源于 LAMDA 团队八年研究。其目标是使机器在物理世界形成对世界的'信念',以世界模型为核心技术路线,将研究成果推向开放物理世界。
近5w颗星!一个能同时指挥多个AI写代码的开源工具来了
现在写代码,很多人想开多个AI助手。Orca是支持多AI Agent的编程开发环境,各Agent在独立git worktree里运行,互不干扰。它功能丰富,还支持多系统安装。
CUDA 20年护城河一个周末崩了 !Claude独自跑通AMD新GPU
一个周末,Claude直接把自家最前沿模型跑在全新AMD MI355X机架,人类工程师没改一行代码。AMD还给AI开发调GPU的工具,ROCm.AI可让Agent自己部署操作。Agent补生态积累短板,对CUDA生态形成降维打击。
DSpark推理速度提升80%后,OpenAI宣布新方法将推理成本降低了一半
近日,OpenAI 工程师开发优化技术,将模型推理成本降一半。业内猜测或基于公开成果,也有人认为是模型量化。此前 DeepSeek 推出 DSpark,使 V4 模型推理速度提升 60%-85%,还引入峰谷定价机制。