全参数微调」共找到 2649 篇相关文章

新闻资讯7

刚被马斯克收购,Cursor掏出新模型:10万卡加持,和Opus、GPT一样大

本周二,刚被SpaceX收购的Cursor在首届旗舰大会宣布新的1.5万亿+参数模型,在超10万块GPU预训练。Cursor CEO称其规模与Opus、GPT相当,还谈了对其他AI实验室看法,新模型将几周内发布。

机器之心
新闻资讯7

OpenAI为龙虾紧急收购了一家23人公司

OpenAI前脚挖来龙虾之父,后脚收购专注AI安与评测的初创公司Promptfoo。该公司开源评测框架流行,有30多万开发者用户。收购后将补齐OpenAI在‘龙虾安’方面关键一环,且继续保持开源。

量子位
新闻资讯7

谷歌Gemini一次提示能耗≈看9秒电视,专家:别太信,有误导性

谷歌报告称处理一个中位数的Gemini文本提示能耗低,2024 - 2025年单个文本提示能耗降33倍、碳足迹减44倍,归功于栈式优化。但专家质疑其方法论,指出未算间接用水、碳排放核算不等问题。

机器之心
新闻资讯8

Qwen3.8-Max 正式版终于发布了,能不能打过 GPT 看这里

Qwen 3.8 Max 正式发布,沿用 Qwen 3.5 架构,参数量扩展,重点提升 Coding、Work 和 Agent 能力。它将开放权重,价格有优势。在多项测试中表现出色,还新增多模态能力,已可使用并有优惠。

MacTalk
开源动态8

清华系团队出手!一张 4090 即可「爆改」,1.3B小钢炮震撼开源

5月11日,清华系团队面壁智能联合多方开源端侧多模态大模型MiniCPM-V 4.6。它参数仅1.3B,性能超阿里、谷歌等同级对手,效率翻倍,还实现两项架构创新,适配主流开源生态,降低开发门槛。

新智元
产品应用7

养了只东北味熊猫当AI合伙人,一口一个老铁,还真帮我开了家「一人公司」

腾讯ima上线copilot模式,可“领养”小熊猫并设定人设风格,成专属知识伙伴。它不分对话和任务模式,知识库功能实用,还能私人定制。作者用它模拟创业,体验良好,其记忆和场景感知实用。

量子位
推荐文章8

AI 开发时代的“能力暴露与禁止空间”方法论:TPDD 与高层测试闭环

文章指出大模型加速软件开发范式演进,AI 深度介入开发带来新生产路径,但也放大风险。作者提出 TPDD 方法论,通过提前定义测试点与边界条件,平衡能力利用与风险控制,确保系统可控、安、可持续。

InfoQ
新闻资讯8

大模型的进化方向:Words to Worlds | 对话商汤林达华

量子位对话商汤林达华,探讨大模型发展。商汤的SenseNova - SI超越李飞飞团队模型,林达华认为单纯依赖参数规模的AI范式遇瓶颈,商汤推出NEO架构革新,还在落地应用优化,为年轻人指明新赛道。

量子位
算法论文8

华人主导谷歌SLED,论文登顶会!一键让模型学会自救

大模型常「瞎编」,传统修复代价高。谷歌在NeurIPS 2024提出SLED方法,不依赖外部知识和额外微调,将各层预测纳入考量,减少模型幻觉。实验显示,SLED能显著提升模型准确率。

新智元
开源动态8

刚刚,大模型装上「鹰眼」!首创高刷视频理解,谷歌Gemini 2.5完败

面壁智能开源MiniCPM-V 4.5多模态端侧模型,8B参数越级反超72B巨无霸,在多领域达SOTA。它首创高刷视频理解,性能强、效率高、适合端侧部署,还实现多技术创新,是开源端侧多模态AI的革命。

新智元