「无预训练模型」共找到 8602 篇相关文章

产品应用8

谷歌Nano Banana Pro上线,深度结合Gemini 3,这下生成世界了

谷歌最新图像生成模型Nano Banana Pro(Gemini 3 Pro Image)上线,结合Gemini 3 Pro强大推理与知识,在控制力、文字渲染和世界知识方面升级,能生成高分辨率、一致性强图像,还支持创意操控、多语言文本生成等,多产品将上线。

机器之心
新闻资讯7

数学家24小时驳回OpenAI攻破的猜想!“AI证对了每句话,但已跟原猜想无关”

OpenAI宣称其下一代AI模型推翻了Connes刚性猜想,第二天堪萨斯大学的J. L. Nielsen就发文回应,指出AI构造的群不满足附加条件,还逐行核对代码指出‘要证什么’有问题,强调人类审查对AI科研结果很关键。

量子位
7

梁文锋首次开口融资,DeepSeek只估值680亿,融资20亿?

据媒体报道,AI初创公司DeepSeek正洽谈以100亿美元估值融资至少3亿美元。该公司此前拒绝融资,此次或因自建数据中心、研发新模型等需大量资金。同时,其两位核心人员跳槽,人才竞争激烈。

机器之心
开源动态7

FLUX.2开源了,但是我好像也看到了小公司的无力。

AI绘图曾经的王者FLUX.2部分模型开源,包括dev和即将开源的klein。但与Nano Banana Pro对比,其生图、改图及世界知识表现欠佳。这凸显小厂在大厂资源碾压下的无力,但开源仍有价值。

数字生命卡兹克
算法论文8

刘鹏飞组发布上下文工程2.0:人机交互的全新视角

刘鹏飞组论文《Context Engineering 2.0: The Context of Context Engineering》重新梳理上下文工程领域。它追溯其20多年历史,给出形式化定义与四阶段模型,探讨关键问题,将其从技术技巧升为系统学科,为理解人机交互提供新视角。

深度学习自然语言处理
开源动态7

Qwen拿半成品刷下AIME'25满分,给别人留点面子吧……

开源之王Qwen的Qwen3“超大杯”推理版虽为早期预览版,仍在训练中,但已在AIME 25和HMMT25达100%准确率,超GPT - 5系列。该预览版可在Qwen Chat免费试用,API已上线阿里云。

量子位
算法论文7

这次,LLM黑盒被LLM打开了~

随着大语言模型(LLM)能力提升,其内部机制更不透明。概念描述新范式用另一个 LLM 自动生成自然语言解释。介绍了描述对象、生成方法、评估指标,还提及社区关注方向,指出结合多种手段才能把解释变知识。

PaperAgent
新闻资讯8

她们估值840亿,刚发了第一个AI成果

估值超120亿美元的Thinking Machines发布首篇研究博客,由创始人、OpenAI前CTO Mira Murati宣发。研究聚焦克服大语言模型推理中的不确定性,探讨推理结果难复现的根源,还介绍解决办法并验证效果。

量子位
新闻资讯7

16岁创业,22岁做成百亿独角兽!3位高中同学帮大厂训AI年入1亿美金

Meta豪掷143亿收购Scale AI,其CEO加盟Meta。这一并购让Mercor创始人Brendan Foody看到机会,认为Scale AI失去中立性,大厂或不再合作。Mercor为AI实验室提供训练人员,年入1亿美金,估值达百亿。

新智元
算法论文8

想知道你的LLM API被过度收费了吗?隐藏的Tokens终于可以被审计了

马里兰大学CASE Lab团队研究商业不透明大模型服务(COLS),定义其风险,提出三层审计蓝图。还推出验证框架CoIn,能高效识别token数量膨胀,有可定制性且审计开销低,为构建信任提供技术支撑。

机器之心