「通用视觉语言」共找到 2225 篇相关文章
登顶 Arena!MiniMax 最新 Speech-02 模型屠榜:超越OpenAI、ElevenLabs,人声相似度99%
近期TTS模型领域发展火热,众多机构纷纷发力。MiniMax推出的Speech - 02模型登顶Arena榜单,在字错率和相似度等指标上表现出色,具备超拟人、个性化、多样性特点,性价比高,还创新架构解决了现有痛点。
黄仁勋提前锁定20年OpenAI芯片收入!第一轮150万GPU卖2000亿美元
英伟达推出‘LPS’概念,联合投资机构出5000亿美元建数据中心,为客户担保。首个项目为在美为OpenAI建150万GPU数据中心,20年或带来巨额芯片收入。黄仁勋也对相关风险做了澄清。
这个周末,很多人都在等一个额度重置,以及对 Work 模式的吐槽
ChatGPT Work 模式上线后,Token 消耗快,用户等额度重置。该模式与 Codex 易混淆,前者处理通用知识类长任务,后者面向软件开发。国内外产品纷纷推 Work 模式,未来或融合。
李想重画具身智能
理想汽车在成立的十一年里,擅长将复杂技术与家庭出行需求对齐。2026年,理想不再满足于打造更好的家庭车,提出造能感知、思考、行动、反馈的硅基生命体。李想提出具身智能上下半场论,理想重构研发体系,以造人方式造车。
谷歌TPU能撼动英伟达吗?前TPU工程师首次揭秘
在AI算力争霸时代,英伟达GPU市值狂飙,但蛋糕正被分食。前谷歌TPU工程师Henry揭秘TPU,从架构、产能、软件等维度分析其优缺点,指出在特定条件下TPU可挑战GPU,未来芯片市场将百花齐放。
RXD大会首发北京:当硅谷还在谈论物理AI,西门子已重写工业规则
3月23日,西门子Siemens RXD大会在北京开幕。西门子首席执行官博乐仁称,AI是通用型技术,公司有贯通硬软件与数据的技术栈。大会发布26款新品,多指向硬件,还展示了数字孪生等应用,凸显数据和行业知识重要性。
永别了,互联网!Anthropic联创爆料:人类彻底出局
Anthropic联创Jack Clark警告熟知的互联网正在消亡。Moltbook作为专为AI智能体打造的社交网络,预示未来互联网将由智能体主宰,人类会感孤独,或需翻译智能体解读局面。
学术海报不用愁,一句话精准自动编辑,华东师大开源APEX
华东师范大学Planing Lab提出APEX框架,能通过自然语言指令实现学术海报局部可控编辑,引入「审查—调整」机制提升可靠性。还构建APEX - Bench评估,实验显示APEX优于其他方法。
SOP:具身智能在线进化新范式,为大规模真实世界部署而生
智元机器人具身研究中心提出SOP在线后训练系统,将VLA后训练重构为“在线、集群、并行”,可即插即用后训练算法。它有高效探索、缓解偏移等优势,实验显示能提升性能、效率,突破VLA瓶颈。
别人在测 Demo,我已经用MiniMax M2.1跑通了整个产品开发流程
作者黄叔用自研产品「降噪」测试 MiniMax M2.1,从 Skills 优化、页面样式、沉浸式交互、智能搜索四个维度检验实战能力。结果显示 M2.1 优势明显,虽有不足,但已能满足多数日常开发任务。