「AI大模型开发」共找到 13828 篇相关文章
Qwen3-VL-Seg 深度解读:当多模态大模型学会"像素级精准手术",仅用0.4%参数碾压8B模型
文章深度解读阿里通义实验室发布的Qwen3-VL-Seg,它解决开放世界指代分割问题,用仅17M参数(占基础模型0.4%)在4B规模超越8B模型。介绍其原理、架构、数据、实验结果,还给出实战代码。
SpAItial发布超逼真3D空间基础模型
德国AI初创平台SpAItial获1300万美元种子轮融资,发布超逼真3D基础模型。其核心技术能理解3D世界,可基于文本或图片生成3D场景,在多领域有革新可能,虽有竞争,但未来有望推动AI三维突破。
那个拍出神作《牌子》的AI导演,带着他的巅峰之作回来了。
本文是对知名AI影像创作者DiDi_OK的专访,DiDi_OK曾创作全网播放近亿的爆款AI短片《牌子》,此次带来他的巅峰新作《糖果》,访谈围绕创作经历、新作内涵、Seedance 2.5的技术升级以及AI时代的创作本质展开。
AI产品能不能火,全看创始人会不会当“网红”?这届AI大佬不拼代码了,个个都是隐藏的社交媒体达人
今年,AI创业者热衷在小红书冷启动产品,创始人分享创业思考,团队招募伙伴,投资人找项目。AI产品成功离不开社交传播,如Lovable、Base44等。但传播不能牺牲产品质量和技术壁垒,创业公司应抓住时间差深耕场景。
喊话特朗普重视AI风险,Anthropic CEO万字长文写应对方案,这方案也是Claude辅助完成的
Anthropic联合创始人兼CEO Dario Amodei写万字长文《技术的青春期》,指出AI飞速迭代下人类面临的危险局面,可能带来国家级安全威胁。文中阐述AI五大系统性风险,并给出应对方案,强调人类制度和成熟度要跟上AI发展。
无需SFT也不用RL,样本级推理优化神器SLOT来了,准确率轻松+10%
西湖大学MAPLE实验室开发的SLOT方法,无需SFT和RL,让模型推理时“临时学习”具体问题。它简单易实现,计算开销小,能使模型准确率大幅提升,还无需额外资源,在各规模模型上效果显著。
对谈openai首席产品,AI时代的产品思路。
知名播客主理人Lenny对OpenAI CPO Kevin Weil进行访谈,分享了OpenAI内部的产品哲学,包括Model Maximalism、Iterative Deployment、Evals等方法论,还谈及AI技术演进、未来机遇等思考,鼓励培养核心能力应对AI变革。
做出ChatGPT核心研究的人今天掀桌:大模型搞不定自动化,新架构提速200倍且输出免费
前OpenAI ChatGPT核心研究员Diogo Almeida,研发两年推出专为业务自动化设计的全新模型Jev,新架构速度比传统大模型提升最高200倍,输出免费,从底层根除类型错误与幻觉,成本远低于主流大模型,已开放早期预览申请。
Anthropic 最新博客:构建 AI Agent 评估体系完整指南
Anthropic 工程团队发布博客《Demystifying evals for AI agents》,揭秘内部对 AI Agent 的评估方法,涵盖评估结构、构建原因、常见 Agent 类型评估技术、评估非确定性处理、构建路线图及与其他方法配合策略等。
Ilya罕见发声:大模型「大力出奇迹」到头了
Ilya大神在近2万字采访中称,AI正从「规模时代」走向「科研时代」,主流「预训练 + Scaling」路线遇瓶颈。他还探讨了AI泛化、安全对齐、预训练范式等热门话题,给出独特见解。