30B - A3B模型」共找到 8074 篇相关文章

算法论文8

罕见!Meta、OpenAI、xAI联合分享了用生产环境提升LLM的最佳实践!

Meta、OpenAI、xAI联合发表成果CharacterFlywheel,聚焦在生产环境提升社交型AI对话能力。团队基于LLaMA 3.1迭代15个版本,7/8的A/B测试显示正向提升,介绍了架构、数据管道、奖励模型等内容。

PaperAgent
算法论文8

单向VLM变双向!人大斯坦福等提出MoCa框架:双向多模态编码器

人大、斯坦福等机构提出MoCa框架,将单向视觉语言模型转化为双向多模态嵌入模型。它通过持续预训练和异构对比微调,解决传统模型局限,在多模态基准测试中表现优异,尤其小规模模型性能突出。

新智元
新闻资讯7

李飞飞做AI游戏,拿了4个亿

李飞飞联创的AI游戏公司Astrocade获5600万美元A+B轮融资。该平台让用户用自然语言描述就能生成游戏,上线8个月有2000万用户、月1.4亿次游玩。其用专门AI模型降低创作门槛,未来发展待察。

量子位
新闻资讯7

突发!Grok4官宣免费,马斯克背刺付费用户也要卷GPT-5。

毫无征兆地,马斯克将刚发布不久的Grok4免费放开,此前使用需付30刀。可能因销量不佳,加上GPT - 5发布带来压力。这引发付费用户不满,也有人提出使用Heavy模型的建议。

开源AI项目落地
开源动态8

41个榜单SOTA!智谱最新开源GLM-4.5V实测:看图猜地址、视频秒变代码

智谱基于GLM - 4.5打造的开源多模态视觉推理模型GLM - 4.5V,在42个公开榜单中41项夺得SOTA。其功能丰富,玩法升级,还为企业与开发者提供高性价比方案,是100B参数级SOTA标杆。

新智元
开源动态8

2张4090竟能本地微调万亿参数Kimi K2!趋境联合清华北航把算力门槛击穿了

仅需2 - 4张消费级显卡(4090),就能在本地对DeepSeek 671B乃至Kimi K2 1TB这样的超大模型进行微调。这得益于KTransformers和LLaMA - Factory两个国产明星项目联动,大幅降低成本,开启AI个性化定制时代。

量子位
产品应用7

太牛了~~复杂表格Cell合并、跨页拼接,中文领域96%,甩MonkeyOCR 20%

在PDF文档解析领域,复杂表格解析是难题。今天分享的OCRFlux是基于qwen2.5vl - 3B模型微调的解决方案,有单页解析和跨页段落/表格合并等创新点,测试得分超96%,远超MonkeyOCR等。

PaperAgent
新闻资讯7

时隔六年,OpenAI 为什么再次开源?

OpenAI发布两款开源纯文本推理模型,时隔六年再次开源。其gpt - oss - 120b性能与o4 mini相当,成本降超10倍。此次开源有战略考量,或是为构建生态、吸引企业,也反映出其对自身价值定位更清晰。

Founder Park
新闻资讯7

对话范浩强:10亿融资之前,我们手搓了5000元“丐版硬件”

原力灵机是具身智能新秀,9个月连融3轮获阿里数亿投资。其创始团队多出自旷视,从To B工业场景切入物流行业。公司发布开源三件套,还将开源基座模型,强调创业要穿越周期,谨慎慢跑。

量子位
算法论文8

LeCun新作反杀AGI派!AI连「鸟」都搞不懂,拿什么超越人类?

图灵奖得主Yann LeCun联手斯坦福团队最新论文揭示,LLM仅在粗糙分类任务表现优秀,精细任务却失灵。研究测试30多个大模型,得出三大发现,指出LLM与人类在概念形成和信息处理上存在本质差异。

新智元