「小脑AI化」共找到 10052 篇相关文章
文本已死,视觉当立!Karpathy狂赞DeepSeek新模型,终结分词器时代
DeepSeek新成果DeepSeek - OCR以像素处理文本,压缩率小于1/10,基准测试领跑,开源一夜获4.4k星。Karpathy力挺,认为应赶走分词器,展望视觉成通用输入前景,马斯克有更科幻猜想。
谷歌月Tokens消耗量领跑全球了:1300000000000000(别数了是千万亿)
谷歌月处理Tokens用量达1.3千万亿,较一年前的9.7万亿大幅增长。横向对比,谷歌在该指标上远超微软等大厂。Tokens消耗量可衡量模型多方面能力,谷歌为行业树立新标杆。
OpenAI 即将发布 Agent Builder,类似扣子、Dify、n8n
据外网爆料,OpenAI 即将于 10 月 6 日 DevDay 发布 Agent Builder,它是工作流自动化工具,有拖拽式画布,能构建 Agent 工作流。对用 OpenAI API 的开发者等是福音,将延伸其平台能力。
北大校友、华人学者金驰新身份——普林斯顿大学终身副教授
华人学者金驰宣布在普林斯顿晋升为终身副教授,任命2026年1月16日生效。他在机器学习理论领域贡献大,为LLM崛起提供数学基石,解决非凸优化和强化学习样本效率等问题。
一文带你通俗易懂的看懂"人工智能+",这是十年一遇的大机遇。
作者解读《关于深入实施“人工智能+”行动的意见》,对比‘互联网+’指出‘人工智能+’核心是‘赋能’,还阐述其在多领域的应用及影响,最后提醒大家面对挑战抓住机遇。
"故宫以东"开启硬核法律讲座,帮助企业提升AIGC版权意识
AI创作大热时,8月13日“故宫以东”平台法律顾问朱子萌开设知识产权法律在线讲座,讲授著作权法“作品”、AIGC作品版权性、输入语料侵权风险等内容,助力企业提升版权意识。
数千大模型全跑「中国芯」!最后一公里已「焊」通
国产芯片运行大模型需额外适配,魔乐社区以开源模型推理适配协作模式破局。它推出‘模型推理适配协作计划’,联合多方力量,打通国产算力与大模型应用‘最后一公里’,还举办赛事激发创新活力。
单卡即可微调大模型!内存占用仅1/8,性能依然拉满 | ICML 2025
基础大模型应用于下游任务时微调成本高,低秩适应(LoRA)方法虽降低成本,但性能不及全量微调。华中科技大学和香港中文大学团队提出GOAT框架,在25个多领域任务验证效果好,内存占用仅1/8。
代码、多模态检索全面登顶SOTA!智源BGE向量模型三连击,并全面开放
检索增强技术在代码及多模态场景作用大,向量模型是关键。智源研究院联合高校研发三款向量模型BGE - Code - v1、BGE - VL - v1.5、BGE - VL - Screenshot,登顶多领域测试基准,已全面开放助力研究与应用。
OpenAI 内部机密文档曝光!其最大竞争对手揭秘
一份OpenAI内部机密战略文档流出,揭露ChatGPT 2025年上半年核心战略,包括向「超级助手」转型,将对手分两类,还提及2025战略重点,不过最大对手信息被打码,引发网友猜测。