「模型开发」共找到 8846 篇相关文章
BLIP3-o统一图像生成与理解,多模态融合趋势显现
BLIP3 - o致力于统一图像理解和生成,提升生成质量与效率。它融合自回归和扩散模型,采用CLIP + Flow Matching架构等。经训练,在图像理解和生成任务表现佳,指令微调效果显著。
红杉专访 OpenAI Codex 团队:AI Coding 的未来,应该是异步自主 Agent
红杉专访 OpenAI Codex 团队,探讨 AI Coding 未来。OpenAI 5 月推出的 Codex Agent 可并行处理多任务、独立完成编程全流程。从代码补全到任务委托,AI 编程朝解放生产力方向发展,团队分享了产品思考等内容。
当人们误解了AI的本质,会发生什么?
文章指出尽管科技公司CEO宣称AI强大,但大语言模型无人类智慧。人们误解AI本质危害多,如将其当精神导师、用AI替代人际互动等,还揭露产业背后廉价劳工,强调要认清AI本质。
H20之后,英伟达全新特供版GPU曝光!单GPU售价低至6500美元
出口管制让英伟达在中国AI芯片市场份额从95%跌至50%。黄仁勋将推出‘阉割版’Blackwell GPU,定价6500 - 8000美元,最早6月量产。还在开发另一款同架构芯片,9月生产。此次尝试结果待察。
每天上线一个新系统,这款腾讯自用低代码有什么不同
腾讯自用低代码平台无极,平均每天上线1.2个新系统,用户覆盖1/3员工。它去模板化,从数据结构设计开始,数据推导UI,有灵活编辑器,支持渐进式开发,具备集成性和开放性,还有AI赋能。
DeepMind:Transformer存在拓扑缺陷,思维链治标不治本
谷歌DeepMind论文指出,Transformer架构不擅长追踪状态,思维链只是给结构性缺陷打补丁,成本高。论文主张用循环架构替代或补充纯前馈结构,还提出多个研究方向,认为下一代模型需构建‘流动的现实表示’。
Langchain创始人最新分享:如何跨越“原型惊艳”到“生产可靠”的鸿沟
近日,LangChain创始人Harrison Chase在Interrupt大会演讲,指出AI行业‘原型易,生产难’痛点。分享优秀Agent工程师四大素质、智能体开发三大关键,还介绍战略预判与产品布局,致力于为智能体工程师提供全周期支持。
给你一套框架,理解AI时代
作者综合多方观点提炼出理解AI时代的三层框架。技术栈分底层模型能力、中层基础设施、上层应用场景;价值链是供给驱动,供给侧突破创造新需求;竞争格局在通用层赢者通吃、基础设施层多元共存、应用层快速迭代。
开源Top2!实测阶跃Step 5 Preview,真有点猛啊…
本文是量子位作者对阶跃星辰新发布的开源旗舰大模型Step 5 Preview的实测与解读,介绍了其参数架构、评测排名、成本优势,展示了多类任务实测效果,分析了技术路线与行业价值。
八年研究沉淀,原方智能试图让机器拥有关于世界的「信念」
原方智能正式启动,由林浩鑫与唐开强创立,技术源于 LAMDA 团队八年研究。其目标是使机器在物理世界形成对世界的'信念',以世界模型为核心技术路线,将研究成果推向开放物理世界。