「关键表征微调」共找到 1367 篇相关文章
刚刚,Sam Altman发文,透露OpenAI正在干的大事业
OpenAI与甲骨文、软银合作新增5个AI数据中心选址,作为星际之门Stargate计划一部分,规划容量达近7吉瓦。CEO Sam Altman称构建强大算力是AI兑现承诺关键,还发文阐述对算力观点。
SMO | 西工大宁晨伽、张伟伟等:基于共享并行神经网络架构的多精度气动融合方法
高可靠性气动数据降本增效是关键命题。本研究总结主流多精度建模方法,提出基于共享并行架构的融合策略,区分公共与私有特征,提升融合框架表征能力,还通过算例验证方法有效性。
AI时代终端大变局
联想、雷神等PC企业在IFA展出AIPC新品,各有侧重。目前AIPC刚起步,距离“终极形态”尚远。市场反馈较好,其增长取决于产品体验、应用落地和产业推动,应用落地是关键,产业发展需全生态链协同。
对谈 DeepSeek-Prover 核心作者辛华剑:Multi Agent 天然适合形式化数学 |Best Minds
文章是对 DeepSeek-Prover 核心作者辛华剑的访谈。他认为强化学习是 AGI 关键解法,Multi Agent 适合形式化数学。还探讨了 DeepSeek Prover 进展、数学与 AGI 关系、评测基准等,指出未来有全才模型和自主 Agent 出现。
Harness 工程实践复盘:100% Cache 命中的 Agent 怎么设计?
本文是 ClackyAI 团队在 Harness 工程实践上的复盘。他们经两代失败后用 Ruby 重写第三代 OpenClacky,总结影响成本和效果的 7 个关键决策,如双 Cache 标记、System Prompt 字节冻结等,凸显 Harness 工程对 Agent 产品的重要性。
Karpathy最新手搓!复现GPT-2成本狂降600倍:仅需507元3小时训练「最好的AI学习项目」
Andrej Karpathy的个人项目nanochat更新,现训练GPT - 2级别的LLM成本低于100美元,在单个8XH100节点上仅3小时花约73美元,较7年前成本降600倍,还列出关键优化技术,设排行榜。
RecGPT-阿里的LLM推荐系统落地方案
文章介绍阿里RecGPT推荐系统落地方案,包括召回和推荐可解释性两方向。召回采用三塔结构,通过挖掘用户兴趣生成商品标签提升召回多样性。还提及行为序列压缩、推荐归因等,以及大模型微调和评估方法。
微软拉响「红色警报」!纳德拉重回一线抓Bug,AI这仗输不起
微软CEO纳德拉亲自下场盯Bug、催进度,吐槽Copilot不够聪明。Copilot嵌入Office却不被用户青睐,AI竞争已从比能力转为比留存。当下用户更看重产品能否被留下,AI竞争关键在于‘分寸感’。
诺基亚坟墓里,埋着半套战胜美国的密码本
文章回顾诺基亚兴衰史,从濒临破产到成为全球手机霸主,后被苹果等超越。其崛起得益于市场机制、人才红利等;失败因利益分配失衡致盟友倒戈。这对中美科技竞争有启示,重塑利益格局很关键。
1.4K Star!不要问答,要完成任务,一个合格的金融Agent应该是什么样?
过去一年AI Agent火热,但金融场景投研是长链路任务,有诸多硬约束。LangAlpha是Ginlix AI推出的开源金融Agent项目,能解决实际金融研究任务,有核心架构和关键能力,还给出使用方式、典型Demo及横向评测。