「大模型聚合平台」共找到 8589 篇相关文章
御三家格局松动:Google和Meta同日发布新模型,第三名不再稳了?
2026年9月2日,Google推出Gemini 3.8 Flash,Meta发布Muse Spark 1.3。此前Google经历人事调整、旗舰延期,靠Flash维持节奏;Meta则重建团队、收窄战略。二者产品定位相似,各有优劣。
教你构建私有 AI Coding 平台:Pi、DSH、Codex Harness 扩展能力对比与选型。
文章聚焦构建私有AI Coding平台,对比Pi、DeepSeek Harness、Codex Harness的架构、扩展能力及选型策略。介绍三者交互集成方式,分析其扩展特点,并为不同需求团队给出选择建议。
AAAI 2025 Oral | 火山引擎多媒体实验室提出VQ-Insight,AIGC视频画质理解大模型
火山引擎多媒体实验室与北大合作论文《VQ-Insight: Teaching VLMs for AI-Generated Video Quality Understanding via Progressive Visual Reinforcement Learning》入选AAAI 2026口头汇报。VQ - Insight用渐进式框架处理AIGC视频画质理解,实验表现卓越。
拒稿警告,靠大模型「偷摸水论文」被堵死,ICLR最严新规来了
ICLR 2026出台大语言模型使用政策,规范作者与审稿人使用LLM做法,明确需如实披露使用情况并担责,违规将受处罚。其他顶会如NeurIPS、ICML等也有相关规定。
苹果新论文发出惊人一问:What do your logits know?
苹果AI研究团队提交论文《你的logits知道些什么?(答案可能会让你惊讶!)》,触及大模型底层逻辑及苹果看重的用户隐私与数据安全。研究通过实验揭示模型信息留存状态,指出存在隐私泄露隐患。
Mistral 3开源,一举超越DeepSeek与K2?
近期,Mistral AI开源Mistral 3,含三款小型稠密模型及Mistral Large 3。Benchmark对比中,它领先国内DeepSeek - 3.1、Kimi - K2。Mistral Large 3是强开源权重模型,Ministral 3适合边缘端,成本性能比低。
性能碾压GPT-4.1-mini!Mistral开源Devstral,还能在笔记本上跑
法国AI初创公司Mistral与All Hands AI合作,发布全新开源语言模型Devstral,有240亿参数,所需算力低,可本地部署。它能解决真实GitHub问题,在SWE基准测试中表现优于多个模型,还能通过API访问。
OpenAI深夜开源HealthBench,60个国家合力开发5000段真实对话
今天凌晨1点30,OpenAI开源医疗大模型测试评估集HealthBench。其5000段核心测试对话由60个国家/地区的262名医生打造,采用多轮对话测试。测试显示大模型在医疗保健领域表现显著提升,还介绍了其构建及评估等情况。
“iFold”,苹果AI新成果
苹果发布基于流匹配的蛋白质折叠模型SimpleFold,被戏称“iFold”。它用通用Transformer模块搭配流匹配生成范式,3B参数版本追平谷歌AlphaFold2性能,还解决了传统模型算力依赖问题,效率高。
Adaptive Reasoning Model:Qwen3混合思考->字节AdaCoT->清华AdaThinking
文章介绍三种处理混合思考模式的方法,阿里 Qwen3 通过 SFT 让模型具备思考能力,但需人为控制;字节 AdaCoT 和清华 AdaThinking 让模型自主决定是否思考,分别用多目标优化和受限优化目标训练。