「模型变笨」共找到 8140 篇相关文章
2025CSDI:大模型引领智能研发与IT组织变革
文章指出AI发展将推动私有知识价值增大,其应用成战略重点。如DeepSeek打破行业固有观念,引领变革。未来智能时代经济源于智能体,AI重构企业生产力,2025CSDI峰会将探讨相关场景应用。
别听模型厂商的,Prompt 不是功能,是 bug
风险投资Conviction创始人Sarah Guo分享2025年AI创业观察,指出从用户体验看,prompt是缺陷非功能;传统低技术行业正快速拥抱AI;还分析了AI能力进展、应用案例及投资机会等。
为什么今天造大模型的人,一半在学物理
文章指出在AI前沿,不少定义方向的人出身物理。物理训练赋予的品味与做AI的方法论高度重合,体现在统计力学与神经网络、对普适规律的信仰等方面,还提到Scaling Laws最能体现这种品味。
从大模型到多模态,图文混排Agent彻底起飞~
上周智谱多模态开源周,从GLM 4.6v到Autoglm,其图文并排使用场景很吸睛。上传PDF论文,它能生成图文混排解读文章,效果好。作者逆向原理复刻代码,还分享GLM 4.6V三个有意思的能力。
AGI 路线图第二阶段:游戏即模型训练|AGIX PM Notes
文章围绕AGI展开,介绍AGI路线图第二阶段“游戏即训练”,指出游戏是训练agent的理想环境;还提及Dreamer系列研究进展。同时涵盖本周市场动态、多家公司AI动态及ETF复制指数的方法、优劣和影响。
免费使用!OpenAI发布ChatGPT记忆功能,秒变私人助理
今日凌晨,OpenAI联合创始人Sam Altamn宣布为免费版ChatGPT提供轻量级记忆功能,未来还会改进。该功能可根据用户对话习惯等个性化回答,对多领域帮助大,文中还介绍了其使用方法及常见问答。
天翼云息壤筑底AI:夯实基建,驱动智变|甲子光年
文章指出AI普及需强大平台架构等作为底座,而当前基础设施迭代难满足需求。天翼云在峰会宣布全面升级息壤,聚焦三领域,从夯实技术、提升自主可控、培育生态三方面支撑千行百业转型。
刚刚,Gemini 2.5 Pro升级,成编程模型新王
Google DeepMind发布Gemini 2.5 Pro (I/O edition),编程能力大幅提升,在编程排行榜超Claude 3.7 Sonnet。用户用一个提示词或草图+描述就能构建应用,谷歌大佬站台,网友实测效果佳。
DeepSeek开源的文件系统,是如何提升大模型效率的?
2月28日,DeepSeek开源高性能分布式文件系统3FS以解决人工智能训练和推理挑战。介绍了分布式文件系统优势,深入解读3FS的组件、CRAQ协议等,还探讨其与其他系统差异及性能相关问题。
Transformer上限触顶,Mobius能否引发下一代模型架构的革命?
自ChatGPT问世,Transformer上限备受关注。前OpenAI、Google负责人称其走到尽头。国内改进架构受算力限制。上海人工智能实验室的书生Mobius团队提出分离知识与推理的架构,有望解决商用等关键问题。