「可灵 2.1 首尾帧模型」共找到 9063 篇相关文章
AI幻觉成WAIC首个关键词,Hinton敲响警钟,讯飞星火X1升级展示治理新突破
今年WAIC上,‘幻觉’成热议词。诺奖得主Hinton、郑南宁院士等指出AI幻觉问题制约其可靠性与实用性。OpenAI等联手研究CoT监测保障安全。讯飞星火X1升级版在幻觉治理等方面取得进步,为可信AI提供佐证。
全球首个 IPO 大模型公司出现!智谱携 500 亿估值开启招股、70% 募资投研发,1 月 8 日登陆港股
12月30日,智谱华章启动港股IPO招股,预计1月5日结束,1月8日挂牌。以每股116.20港元计,募资约43亿港元,市值超511亿港元。70%募资用于大模型研发,还引入多家基石投资者。
QClaw V2 升级:微信里直接用的龙虾,真正走入你生活和工作的个人助理
3月8日QClaw发布后文章爆火,近期产品迭代快。QClaw V2引入Multi - Agent机制,可创建多角色AI助手并行工作,还能连接主流办公工具,集成龙虾管家保障安全,实测功能强大,优势明显。
256块NPU训成8B视频模型、超越Sora等一众闭源!抖音内容技术团队开源ContentV
近日,抖音内容技术团队开源ContentV,这是面向视频生成任务的高效训练方案。用256块NPU约4周训成8B参数模型,在多评估维度效果与主流方案相近,还探索了有限算力下训练路径,现推理代码与权重已开放。
原力灵机发布Realtime-VLA V2:从遥操作到真实部署,VLA提速的系统解法
原力灵机发布《Realtime - VLA V2》技术报告,在VLA控制下让机器人快速运动。实现数倍于遥操作采集训练数据的速度执行VLA,解决了遥操作数据采集、时序延迟等问题,还通过“油门式采集”提升速度,但离人类性能仍有差距。
谷歌最新 Gemini Agent 爆击GPT-5.2?人类最后考试得分见分晓!网友:Altman又该发“红色警报”了
全球人工智能竞争升温,谷歌与 OpenAI 同日发布更新。谷歌推出全新 Gemini Deep Research 版本及嵌入式研究智能体 API,OpenAI 发布 GPT - 5.2。谷歌新工具能力提升,测试成绩佳,引发网友不同看法,二者竞争激烈。
比Vibe Coding强100倍!字节 Trae 2.0 携“上下文工程”登场:一句话,从需求干到上线!
字节跳动的AI编程助手Trae发布2.0版本,新增SOLO模式,支持端到端开发流程。上下文工程热度攀升,能解决AI代码落地问题。Trae迭代快,从基础问答进化为智能体系统。
Unify:9个月两轮融资估值2.6亿美元,AI 自动化销售赛道跑出新独角兽
AI销售自动化平台Unify完成4000万美元B轮融资,投后估值2.6亿美元。其核心产品解决销售数据孤岛等痛点,20 - 30%营收来自自用。虽面临竞争,但有独特优势,未来挑战与机遇并存。
斯坦福与Adobe新研究,模仿蒸馏技术轻松让200亿参数图像生成高质量大模型
斯坦福大学和Adobe研究院联手,用pi - Flow技术让200亿参数文本到图像大模型4步内生成高质量、高多样性图片。此前少步生成有质量和多样性问题,他们推出GMFlow和pi - Flow解决难题,LakonLab是其背后工程支撑。
老外傻眼!明用英文提问,DeepSeek依然坚持中文思考
DeepSeek-V3.2和DeepSeek-V3.2-Speciale推理能力显著提升,海外研究者用英文提问,它却用中文思考。评论有两种观点,相关论文显示中文省token但非最有效,大模型选思考语言并非只看效率。