「自优化」共找到 2185 篇相关文章
刚刚DeepSeek宣布大规模扩张,整体至少扩员一倍,全体岗位集体喊人加入
DeepSeek宣布大规模扩张,各部门规模至少扩一倍。其发力点包括底层算力与系统优化、高质量数据、Agent与应用落地及探索Next Level科研。用人反内卷、反官僚,岗位接受实习,还新增AGI核心业务管培生。
技术·艺术· 算术:京东零售 AIGC 百亿素材供给实践
本文整理自 QCon 全球软件开发大会·2026 石孝钢演讲。京东零售面对百亿级商品素材供给难题,构建 Oxygen Vision 系统,从艺术、技术、算术三方面探索,实现日供超 1000 万素材,服务超 100 万家商家,核心 XTR 综合提升 29%。
GPT之父:只用上世纪数据训AI,它居然也会写Python?!
GPT之父Alec Radford团队训练出talkie - 1930 - 13b模型,其训练数据截止1931年。该模型能说新政立法、写Python代码。团队还对比其与现代模型,发现核心能力差距不大,且用老语料调教它成聊天助手时现风格问题。
DeepSeek V4没做的,MiniCPM-o 4.5给做「全」了~
上周 DeepSeek V4 发布,遗憾不是多模态。今天 MiniCPM-o 4.5 补上短板,凭 9B 参数实现端到端全双工全模态大模型,自 2026 年 2 月发布后 Hugging Face 下载量超 25 万。还推出多项成果,性能表现出色。
让大模型理解真实医疗视频,全球首个开源技术方案来了!
AI 进入医疗领域需谨慎,此前美国引入不成熟 AI 致手术失误频发。全球首个医疗视频理解大模型元智医疗视频理解大模型发布并开源,解决了医疗视频领域的任务优化、数据缺失和无法评测痛点。
万帧实时!流式3D重建天花板,被国产开源模型打破了
蚂蚁正式开源 LingBot-Map,这是基于几何上下文 Transformer 的纯自回归流式 3D 重建基础模型。它能在恒定内存下实现超万帧长视频实时三维重建,处理速度约 20 FPS,在多基准测试中超越现有流式方法。
大模型能“原地”改参数了!字节Seed&北大新论文:测试时推理无需加层重训练
字节Seed和北大研究团队提出In - Place TTT方案,让大模型能“原地改参数”。它复用Transformer的MLP模块,解决现有TTT架构不兼容、计算效率低和优化目标不匹配问题,实验证明可提升模型长文本任务表现。
从云原生到 AI 原生:模型引发的新一代基础设施构建
本文整理自蚂蚁集团余锋在2025年QCon上海站的分享。回顾基础设施从云计算到AI原生的演进,指出模型成新数据库,基础设施围绕其构建,还探讨了Agent体系影响、通智一体趋势及面临的挑战与机遇。
AI下一前沿是模拟社会!「斯坦福AI小镇」创业后,西部世界雏形初现
业界热议人工智能的下一个前沿,斯坦福大学副教授 Percy Liang 认为是模拟社会,他所在创业公司完成 1 亿美元融资。模拟社会可预测情景、优化结果,Simile 团队开创 AI 模拟领域,但面临开发模型、高效模拟、建立信任等挑战。
20亿砸向00后创业机器人公司!估值一年暴涨7倍,国家级资本重仓
近日,灵初智能完成约20亿元天使轮及Pre - A轮融资,资金将用于物流场景落地与数据采集体系建设。其团队互补,突围逻辑是All in人类原生数据,自研采集方案,走“模型驱动数据”路径,定位“大脑驱动公司”。