「文章生成流程」共找到 4097 篇相关文章
AI原生数据库的思考
文章围绕AI原生数据库展开,分析企业应用大模型的问题,指出AI场景驱动数据库新工作负载。探讨AI数据库变与不变、实现路径,介绍原生混合搜索、现代数据架构、数模融合等,还提及seekdb的发布、定位、优势与不足。
DeepSeek V3.2爆火,Agentic性能暴涨40%解密
文章解密了DeepSeek V3.2 Agentic性能暴涨40%的原因,即采用交错思维链机制。还对比了其与早期ReAct范式,介绍其效果、原理,以及MiniMax为落地该机制做的工作,最后提到多家模型达成技术共识。
北京艺术与科技周|三联人文城市跨界沙龙:当AI开始写诗、作曲,我们会如何改变?
在算法推荐和AI生成内容充斥的当下,美学标准和感知方式被颠覆重塑。北京艺术与科技周的三联人文城市跨界沙龙,邀胡德夫、叶蓓等嘉宾以诗为起点深度对谈,探讨AI时代美学与人文生活新可能。
机器人的 GPT 时刻比我们以为的更近|AGIX PM Notes
文章认为机器人的 GPT 时刻可能比想象更近,未来 2 - 3 年或出现较通用机器人,3 - 5 年有望规模化部署。还分析了当前机器人发展情况、瓶颈及数据获取方式,同时介绍了上周市场动态和多家公司的 AI 相关事件。
以史为鉴:从互联网泡沫到英伟达五万亿
文章回顾互联网发展历程及泡沫破灭影响,对比当下AI浪潮,指出英伟达成首家市值破五万亿美元公司。探讨AI是否为泡沫,认为其未来发展或类似互联网,还分析英伟达走势及国产GPU替代、AI边缘推理领域前景。
Wan2.2-Animate又火了,5分钟让抠脚大汉秒变高冷女神。
阿里开源模型Wan2.2 Animate又火了,用照片和视频就能生成换脸视频,表情动作复刻佳。它上限高,还能变声,可用于舞蹈视频、影视二创等,但手指易崩坏。模型开源,有积极意义也有风险。
传统训练效率很低?我们靠 “给模型降噪” 重新审视长上下文建模难题
文章指出长上下文模型处理长文本时易受噪声干扰,提出新评估指标IG分数和“上下文去噪训练(CDT)”方法。实验表明CDT优于现有策略,经其训练的开源模型在长上下文任务中性能媲美GPT - 4o。
马斯克「世界模拟器」首曝,1天蒸馏人类500年驾驶经验!擎天柱同脑进化
特斯拉官宣「世界模拟器」,可模拟、合成自动驾驶的「孪生世界」,生成不同视角和长尾场景。它基于端到端神经网络,有学习人类价值观等优势。还能用海量数据解决难题,输出可解释中间结果,为自动驾驶和擎天柱训练服务。
小白必读:到底什么是FP32、FP16、INT8?
文章介绍FP32、FP16、INT8等数字存储格式类型。指出它们是评估算力前提,不同格式在精度、范围、内存占用和计算速度上有差异,还提及多精度与混合精度计算,以及不同硬件对格式的支持情况。
仅100种子题,合成数据质量超GPT-5,阿里、上交提出Socratic-Zero框架
阿里巴巴与上交大联合提出 Socratic-Zero 框架,仅从 100 个种子问题出发,通过三智能体协同进化生成高质量课程。该框架合成数据质量超 GPT - 5 等,Solver 性能提升显著,工程友好,开启零数据自进化新路径。