「大语言模型(LLM)」共找到 8209 篇相关文章
他救了OpenAI、年赚过亿、三家明星CTO,却自曝跟不上AI发展了!硅谷大佬告诫:不是马斯克,就别碰大模型
Bret Taylor履历丰富,曾助力OpenAI解决危机。他认为AI市场将分化为前沿基础模型、AI工具层和应用型AI三个板块,不建议普通创业者做基础模型,看好应用型AI中Agent生态。还分享创业、编程等多方面见解。
MIT天才博士刚毕业,就被前OpenAI CTO抢走!年薪或300万起步
MIT天才博士肖光烜刚毕业就官宣加盟Thinking Machines,主攻大模型预训练。他履历耀眼,博士论文破解LLM三大难题,构建高效大模型框架。Thinking Machines薪资可观,平均年薪超OpenAI等公司。
动态RAG新工作:效果爆了,代码已开源
大语言模型幻觉问题突出,现有动态RAG方法信号不可靠。QuCo-RAG从预训练语料库挖掘统计证据,用客观频率替代主观置信度,实现毫秒级幻觉检测与动态检索触发,代码已开源。
面壁MiniCPM-V4.5新王炸!8B手机10FPS长视频秒懂,文档手写全能识别!
面壁上新最强端侧多模态模型MiniCPM-V 4.5,基于Qwen3 - 8B与SigLIP2 - 400M构建,总参数量8B。它视觉语言理解强、手机能跑,有高帧率视频理解等特点,还有多方面技术亮点。
ICML 2026获奖论文揭晓:黄高团队获杰出论文,A3C算法获时间检验奖
ICML 2026公布最佳论文奖项,共10篇获奖,涵盖杰出论文奖、杰出立场论文奖等。此次评选严格,经多轮筛选。获奖论文涉及扩散式大语言模型、扩散模型采样算法等多个领域。
首个自主数据科学的智能体
DeepAnalyze是业界首个能自主完成数据科学任务的智能体大语言模型,可自动执行数据准备、分析等任务,支持多种数据源,且模型、代码等全部开源,还给出了使用和开发方法。
AI文本转语音进入“Next Level”!独角兽ElevenLabs发布Eleven v3:狠狠拿捏情感控制
独角兽ElevenLabs发布最新版TTS模型Eleven v3,支持70多种语言,能进行多人对话,生动展现情绪语气。官方称其为“迄今为止最具表现力的文本转语音模型”,网友实测好评居多,但中文效果不如英文。
Codex+hyperframe做视频,让剪辑师们慌了?
开源项目Hyperframes刷屏,它是基于HTML的视频渲染框架,不用视频大模型,用普通语言模型就能生成可控视频。它与Remotion有区别,选了对AI友好的路,还介绍了安装、使用方法和适用场景。
以小博大,仅1.7B媲美gemini2.5-pro,达到SOTA文档解析性能
dots.ocr是多语言开源文档解析器,把布局检测和内容识别统一在视觉语言模型中,虽LLM仅1.7B参数,却达SOTA性能。介绍了其预训练三阶段及SFT阶段关键策略。
GPT-5仅23.3%,全球AI集体挂科!地狱级编程考试,夺金神话破灭
最新基准测试SWE-Bench Pro评估AI编程智能体,直面真实企业级工程任务。顶尖模型几乎溃败,GPT - 5仅23.3%。该测试解决现有基准数据污染、任务简单问题,能成未来LLM编码能力标尺。