「模型结构创新」共找到 8562 篇相关文章
不用上传数据了!苹果正式开源 Embedding Atlas,用 Rust+WebGPU 在桌面实现科研级数据分析
苹果发布开源工具 Embedding Atlas,支持对大规模嵌入向量交互式可视化与探索。它在浏览器端运行,保障数据隐私,有多种可视化功能,提供 Python 包和 npm 库,已在 GitHub 开源。
官方文档翻译:Nano Banana Pro 终极开发指南
本文是 Nano Banana Pro 开发指南,介绍其通过‘思考能力’、实时搜索和 4K 画质构建应用。涵盖在 Google AI Studio 试玩、环境搭建等内容,还给出使用最佳实践与提示词技巧。
DeepSeek悄悄开源LPLB:用线性规划解决MoE负载不均
昨天,DeepSeek 在 GitHub 上线新代码库 LPLB 解决 MoE 负载不均。它利用线性规划算法优化专家并行工作负载分配,能处理动态波动,但也存在忽略非线性成本等局限,对 MoE 架构训练加速有参考价值。
88%的公司在用AI,但只有39%吃到真金白银?麦肯锡2025 AI报告来了!
麦肯锡《The State of AI in 2025》显示,88%受访企业用AI,但仅39%获财务回报。多数企业AI在试点,Agent落地少,高绩效企业享红利,AI岗位影响招聘结构。
卡帕西8000行代码手搓ChatGPT,成本仅100美元,训练12小时CORE表现超越GPT-2,手把手教程来了
AI大神Andrej Karpathy新作nanochat,用8000行代码、100美元成本纯手搓克隆ChatGPT。它是极简全栈训练/推理pipeline,训练12小时,CORE表现超GPT - 2,还给出快速上手详细指南。
两份报告,两种 PMF:ChatGPT 跑通了 Copilot,Claude 验证了 Agent
OpenAI和Anthropic发布核心产品使用报告,展现ChatGPT和Claude用户心智差异。ChatGPT像Advisor,以询问、写作为主;Claude似Agent,随模型能力提升,用户倾向用其执行自动化任务。
攻克AI过度思考难题!美团新研究让通过“可验证”过程奖励激活LRM的高效推理
美团等机构研究团队针对LRM“过度思考”问题,提出可验证的过程奖励机制(VSRM)。它结合可验证奖励与步骤级奖励,为推理步骤分配奖励信号。实验显示其能降低输出长度并保持性能。
AGI 投资清单:为什么这 30+公司值得关注?|Best Ideas
今年 AI 进入‘业绩兑现期’,市场看重真实效益和收入。文章围绕技术、资本开支和宏观趋势筛选 30+ 公司,覆盖多领域,分析各公司优势与投资价值,为投资者提供参考。
突破具身智能“专家困境”!北大新方法让宇树G1靠单一框架掌握跳舞和侧手翻
北京大学与BeingBeyond团队联合研发的BumbleBee系统,用创新的‘分治 - 精炼 - 融合’三级架构,实现人形机器人在多样化动作中的稳定控制,破解传统控制策略的‘专家困境’与‘现实鸿沟’。
Claude Code 开发者谈如何用 Claude Code 开发 Claude Code
Anthropic的Claude Code创建者Boris Cherny在访谈分享智能体编程未来看法,介绍用Claude Code开发它自身的方法,还谈及Claude Code发展、使用技巧及对编程工作未来变化的预测。