「元数据性能」共找到 4680 篇相关文章
终于!OpenAI 开源了2款模型:gpt-oss-120b 和 gpt-oss-20b
OpenAI 发布 gpt-oss-120b 和 gpt-oss-20b 开源模型,性能出色,如 120b 版本媲美 o4-mini,20b 版本能在笔记本甚至手机运行。采用 Apache 2.0 许可证,有多种特性与运行方式,还经安全分析。
Openai-o3 做不到的事,7B 模型做到了! 推荐系统“慢思考”,广告收入暴涨 4.1%
随着GPT - 4等大语言模型兴起,LLM用于推荐系统遇瓶颈,当前方法停在‘System - 1思维’阶段。A4ec框架把LLM从‘快思考’升级到‘慢思考’,用7B模型实现推荐系统升级,使广告收入暴涨4.1%。
训练效率提升25%、成本降23%!上海期智研究院、算秩未来联合推出MegatronApp:专为万亿参数大模型训练打造的系统工具包
上海期智研究院联合算秩未来在WAIC 2025大会发布开源项目MegatronApp,它是国内首个围绕Megatron - LM的增强工具链。经实际数据,其在该框架下训练效率提25%、成本降23%,含四大模块解决训练难题。
量旋科技完成B轮融资,资本为何重注看似遥远的量子计算?|甲子光年
近日,量旋科技完成数亿元B系列轮融资。量子计算市场前景大,虽面临挑战,但产业正从技术研发迈向产业化。量旋科技选超导与核磁共振两条技术路线,其发展分三阶段,未来或与AI结合。
黄仁勋中国现场直击!假如有一个「数字黄仁勋」,我希望我们一起变聪明
英伟达CEO黄仁勋再访北京,接受新智元等媒体采访。他盛赞华为优秀,评价DeepSeek等模型出色,还谈及AGI、数字分身、出口管制等话题。此外,H20芯片解禁重售释放政策信号,有望实现中美科技企业合作共赢。
甲小姐对话彭志辉:既然选择做公众人物,就必须接受被期待的代价 | 甲子光年
甲子光年的甲小姐对话智元机器人联合创始人彭志辉,他称公司是具身行业估值“撑伞人”,采用全栈自研战略。双方还探讨融资、战略、市场、技术、商业、组织等话题,他分享公司发展现状、前景及应对策略。
模型遗忘不代表记忆抹除!首次系统发现「可逆性遗忘」背后规律
研究人员发现大语言模型遗忘并非简单信息删除,可能藏于内部。他们构建表示空间诊断工具,区分可逆与不可逆遗忘,揭示真正遗忘是结构抹除。还在多种方法、数据集和模型上实证,得出系列结论。
72小时AI生存挑战,发生了什么?
五源发起72小时AI生存挑战,7位不同背景参与者在封闭空间,仅用AI工具和100元资金生存并创造。有人训练AI朋友,有人创作作品。过程中暴露诸多问题,也让大家看到AI能力边界与未来可能。
o3绞尽脑汁仅答对40%的题目,开源模型基本乱猜?MMSI-Bench:多图空间智能试金石
文章介绍了MMSI - Bench,这是用于评估MLLM多图像空间推理能力的VQA基准。它人工构建样本、全面分类任务、采用多样真实数据。实验显示MLLM在多图像空间推理有短板,还开发自动化错误分析流程助力改进。
Agent与工具交互平台级探索,只用接入一个MCP服务就能调用6000+工具
在模型性能趋同背景下,知识库、工具成AI应用差异壁垒。MCP规范Agent与工具交互,但在实际生产中有挑战。ACI.dev项目维护者Aipotheosis Labs探索简化Agent与外部工具集成等过程,对企业级应用有示范意义。