「智能体验」共找到 4037 篇相关文章
刚刚,小红书开源了首个多模态大模型dots.vlm1,性能直追SOTA!
小红书人文智能实验室(hi lab)低调开源视觉语言模型dots.vlm1。该模型基于自研视觉编码器构建,在视觉理解和推理任务上接近SOTA水平,实测表现惊艳,还介绍了其技术架构、预训练数据布局等内容。
AI 播客原理解析
作者分享用豆包AI播客将英文长文转成高质量播客的体验,解析AI把文章变真人对话式语音播客的原理,涉及提示词工程和文字转语音技术,还介绍提示词写作与优化过程及长文处理方法。
刚刚,OpenAI正式发布o3-pro!奥特曼激动更新博客:温和的奇点
今日凌晨,OpenAI发布o3-pro,Pro订阅用户可通过ChatGPT和API使用。其在多项任务表现出色,但在ARC-AGI数据集上与o3相近且成本高。网友测试评价不一,此外OpenAI CEO奥特曼还发表博客展望AI未来。
DGM:首个可通过重写自己的代码来实现进化的AI Agent
Sakana AI发布Darwin Gödel Machine(DGM),可通过重写代码自我进化,突破了当前AI Agent智能固定的局限。它在多测试中表现出色,能力具通用性,但也有潜在风险和局限,团队已开源并提出未来研究方向。
微软CPO专访:Prompt是AI时代的PRD,产品经理的工作方式已经彻底变了
微软首席产品官 Aparna 认为,Prompt 正取代传统 PRD 成构建产品起点,NLX 将成新用户体验设计范式,还解释了 Agent 核心特征。她觉得 Agent 本质是工具,未来可让其承担更多任务,产品经理关键在于「好品味」和「编辑能力」。
LeCun三顾茅庐,谢赛宁终于入伙!新公司获投10亿美元
图灵奖得主Yann LeCun创立的世界模型初创公司Advanced Machine Intelligence(AMI)宣布完成10.3亿美元种子轮融资,估值35亿美元。DiT作者谢赛宁加入任联合创始人兼CSO,CEO是Alex Lebrun。公司目标是打造理解现实世界的智能系统。
Node.js之父宣判“手写代码时代结束”!DHH明确反对“结束论”:大模型还差口气,手写更有竞争力
Node.js之父Ryan Dahl宣称人类写代码时代结束,而Ruby on Rails作者DHH反对,认为大模型还差口气,手写代码仍有竞争力。DHH分享AI使用体验,指出距AI带来明显优势的拐点还差一点,还探讨互联网和产品发布等问题。
智谱新模型也用DeepSeek的MLA,苹果M5就能跑
智谱AI上市后发布新成果,开源轻量级大语言模型GLM-4.7-Flash,API免费开放调用。该模型是30B总参数、3B激活参数的MoE架构,定位为“本地编程与智能体助手”,评测表现佳,采用MLA架构,多平台支持。
读万卷书,大模型就能「看」懂视觉世界?Meta揭秘LLM视觉先验的起源
Meta超级智能实验室与牛津团队新论文发现,只见过文本的大语言模型(LLM)能学到可迁移到视觉任务的先验能力。研究通过超100组受控实验、耗费50万GPU小时,揭开LLM视觉先验来源,还给出预训练数据配方。
高阶程序,让AI从技术可行到商业可信的最后一公里
文章指出进入AI下半场,可靠性成关键。当前多种探索路径有局限,企业常用RAG、智能体框架等方案也各有问题。而高阶程序(HOP)是神经 - 符号思想的工程实践,能为AI构建可靠控制系统,已在金融等行业展现价值。