设计到代码」共找到 4472 篇相关文章

算法论文7

Transformer上限触顶,Mobius能否引发下一代模型架构的革命?

自ChatGPT问世,Transformer上限备受关注。前OpenAI、Google负责人称其走尽头。国内改进架构受算力限制。上海人工智能实验室的书生Mobius团队提出分离知识与推理的架构,有望解决商用等关键问题。

机器之心
开源动态7

小模型也能精确计算:WorldModel-Qwen的推理时代码执行实验

开发者bigattichouse让Qwen - 0.6B小模型推理时生成并执行WASM代码获计算结果。最初尝试加标签生成Python代码效率低,后用WASM,创建三层架构。虽结果未完美,但接近,还通过Gemini审查验证。

AI工程化
产品应用7

走一步看一步、两三个月就迷茫一次:字节扣子的两年「创业」

字节的扣子刚完成大版本更新,定位“职场AI,就用扣子”。它过去两年像早期创业团队“野生”生长,从Bot Studio工作流平台,再扣子空间,如今迈向Vibe Coding,强化“伙伴”定位,值得产品创新者研究。

Founder Park
算法论文8

UIUC清华微软联合提出PlugMem:当Agent记忆告别「经历」,开始存储「经验」

随着大语言模型Agent长期运行,‘记忆该如何设计’成核心问题。UIUC、清华、微软联合提出PlugMem,将记忆拆分为三类,以知识为单位存储,在三类任务中验证其有效性,为Agent长期记忆设计提供新思路。

机器之心
推荐文章8

AI 怎么自我改进?Lilian Weng 的答案是:先写好Harness

提出 Agent 基本公式的 Lilian Weng 探讨 AI 递归自我改进,强调‘harness’重要性,介绍其设计模式、优化方法,还提及未来挑战与有用基准。如 harness 工程额外包含工作流设计等,优化方式多样但也面临评估器弱等问题。

AI工程化
开源动态8

中山大学&华为联合提出 Issue Resolution 数据集构建神器SWE-Factory:每条只要$0.024

中山大学和华为联合提出低成本开源方案 SWE-Factory,可自动收集代码打造高质量代码评估数据集。它能解决传统构建流程繁琐、依赖人工的问题,实现全流程自动化,还构建了 SweSetupBench 数据集,表现出色。

深度学习自然语言处理
新闻资讯8

OpenAI重大发现:GPT-4b micro改造诺奖研究,山中因子重编程效率提高50倍

OpenAI与Retro Bio合作,用新模型GPT - 4b micro设计出新型山中因子变体,使重编程效率提高50倍。此前山中因子重编程效率极低,限制其应用,此次改进是突破。研究还在多方面验证了变体效果。

机器之心
开源动态7

LangChain Memory 太弱?试试用 MemOS 构建 Agent 专属的“记忆图谱”。

文章聚焦 MemOS 开源框架,深入体验其记忆“图谱”能力,探讨将它集成基于 LangChain1.x 框架构建的智能体的方法。介绍了基于记忆“图谱”构建 ChatBot、体验记忆“图谱”自动重组,以及集成 LangChain 智能体等内容。

AI大模型应用实践
产品应用7

Google Antigravity vs Claude Code,我觉得还是Claude Code好

作者用相同prompt测试Google Antigravity和Claude Code的代码生成能力。Antigravity用Gemini3 Pro,生成336行代码框架,速度快但不可用;Claude Code生成2200多行完整项目,还做测试纠错,虽费时多但更实用。

AI与安全
新闻资讯7

DeepSeek不惜代价保住它!V4关键特性被挖出来了

DeepSeek V4技术报告被深挖,为保留核心设计「batch invariance」不惜代价。该设计能保证线上推理稳定、各环节对齐,是复杂上下文系统底座,但会牺牲GPU利用率等,换来训练等多阶段可复现和稳定度。

量子位