小模型」共找到 8227 篇相关文章

开源动态7

一个强大的知识图谱生成工具

这是基于Streamlit的应用程序,用LangChain和OpenAI的GPT模型从文本提取图谱数据并生成交互式图谱。有两种输入方式,具备可视化等特性,还给出安装、运行等指南。

GitHubStore
开源动态7

完全复刻火爆全网的机器鸭

这是对Pollen Robotics Microduck的第三方复刻研究,从官方公开的MJCF仿真模型反推出装配图、爆炸图和可直接导入CAD的装配体。该机器鸭软件开源、硬件不开源,但已有信息足以还原装配关系。

GitHubStore
算法论文8

给 Agent Skills 装上眼睛:MMSkills 用多模态技能包教会智能体看状态、做决策

上海交通大学和红书团队推出面向通用视觉 Agent 的多模态技能框架 MMSkills,将可复用技能扩展为多模态程序性知识,通过 branch loading 调用视觉证据,在 GUI 与游戏任务评测中表现出色。

深度学习自然语言处理
算法论文8

北大、字节、中科院自动化研究所等提出图像并行生成新范式

北大、字节等团队发现多模态模型先思考后作画会降低图像语义保真度,因自回归架构有误差传播问题。为此提出并行多模态扩散框架MMaDA - Parallel,构建ParaBench基准,多项优化后在测试中击败Bagel。

AIGC开放社区
新闻资讯7

DeepSeek R2没来,DeepSeek R1+来了~

DeepSeek官方发布通知,DeepSeek R1模型完成版本升级成DeepSeek - R1+。PaperAgent实测近1000行代码无错,网友测试显示CoT有显著变化、前端审美提升,还提及DeepSeek - R2可能快来了。

PaperAgent
新闻资讯8

OpenAI Astra发布在即,全自动网络攻防能力已突破天际!

OpenAI即将发布的模型Astra,在内部评测中获ExploitBench满分,还发现两个零日漏洞。它能力远超上一代GPT - 5.6 Sol且更听话。不过为安全考虑,OpenAI部署监控,还放慢其研究速度。

新智元
开源动态8

5.6K Star!原本付费现在开源!本地版“ElevenLabs”,视频翻译+声音克隆全免费!

今天给大家安利GitHub上开源神器Voice - Pro,它原本是商业付费软件,因团队无暇管理而开源。整合多个先进语音模型,将视频处理流程打包成本地软件,免费且功能强大。

开源星探
新闻资讯8

谷歌Pixel发布汇总:硬件与软件全面AI化,那谁你就学叭

谷歌2025年硬件发布会展示众多AI能力,如Gemini驱动的健康教练、拍摄指导、智能大屏设备等。Pixel 10手机搭载芯片可本地运行模型,还有多项实用AI功能,凸显硬件与软件全面AI化趋势。

歸藏的AI工具箱
开源动态8

腾讯混元最新开源:一套RL框架打通多个模态,庞天宇团队新作

大语言模型的RL技术已成熟,但多模态生成模型的强化学习训练仍“各自为战”,制约AIGC模型能力上限。腾讯混元庞天宇团队开源UniRL框架,打通多模态RL后训练,覆盖多种模型,内置算法与奖励组件。

量子位
开源动态8

Karpathy再放大招:8000行代码复现ChatGPT全栈,最低成本仅100美元,4时跑完

Andrej Karpathy发布项目nanochat,是全栈式ChatGPT克隆体训练/推理流水线,代码约8000行,覆盖训练分词器、预训练等完整流程。介绍不同成本下模型表现,还回答网友关于架构、训练数据等问题。

AI寒武纪