「速度与准确性」共找到 6962 篇相关文章
真正的一句话修图:Gemini 用香蕉模型给出了图像生成的分水岭
Google新模型Gemini 2.5 Flash Image可在AI Studio体验。它有多图融合、角色一致性等能力,能实现自然语言编辑图像,速度快、价格低、API可用,虽有中文体验等问题,但有望让AI视觉工具进入工程化时代。
前 Codex 大神倒戈实锤!吹爆 Claude Code:编程提速 5 倍,点破 OpenAl 死穴在上下文
OpenAI Codex 早期研发者 Calvin French - Owen 在播客中锐评代码智能体,偏爱 Claude Code,称其搭配 Opus 模型写代码速度提 5 倍。他强调上下文管理重要性,还对比了 Claude Code 与 Codex 产品理念差异。
腾讯发布大模型思考早停算法SpecExit,效果无损,端到端加速2.5倍!
腾讯为破解大模型长思维链效率难题,提出思考早停算法SpecExit,将思考早停与投机采样融合,在不影响准确性前提下,在vLLM上实现端到端加速2.5倍,还能缩短思维链长度。
模型即智能体,Kimi K2 Thinking多项评估超越顶尖闭源模型,300轮工具调用不疲倦
月之暗面发布Kimi K2 Thinking,它是Kimi迄今最强开源思考模型,基于模型即智能体理念训练,可自主连续工具调用与多轮思考,多项评估超顶尖闭源模型,还实现原生INT4量化,提升生成速度。
专为“超大模型而生”,新一代训练引擎 XTuner V1 开源!
9月8日,上海AI实验室开源书生大模型新一代训练引擎XTuner V1。它能应对复杂训练场景、速度更快,尤其在超大规模稀疏混合专家(MoE)模型训练中优势显著。还将一并开源AIOps工具DeepTrace与ClusterX。
腾讯Kuikly框架进一步开源,新增支持Web,开启一码五端新体验!
腾讯Kuikly框架进一步开源,新增Web版支持H5和微信小程序。该框架基于Kotlin Multiplatform,已被20+业务深度使用。与主流框架对比,它在产物大小、加载速度等方面优势明显,还将持续优化和拓展。
谷歌邪修Gemini 3.8 Flash!险胜DeepSeek,姚顺宇:RSI一大步
谷歌发布Gemini 3.8 Flash,编码能力提升,在LMArena榜单险胜DeepSeek-V4-Pro,定价与3.7 Flash一致。其输出速度快,但有网友质疑是刷分。此外还有3.8 Flash Cyber,网络安全能力强却不公开发布。
开源大模型SOTA又刷新!中国MiniMax M2全球排名第五,开源榜一
中国AI独角兽MiniMax发布模型M2,刷新开源SOTA。它采用混合专家架构,平衡了智能、速度和成本。在多个权威测试中表现优异,价格仅为Claude 3.5 Sonnet的8%,还提供多种部署方式和限时免费服务。
Claude Opus 5 发布:Fable 5 一半的价格,更强的编码能力
Anthropic 发布 Claude Opus 5,定价与 Opus 4.8 相同,价格是 Fable 5 的一半。它在编码、知识工作和推理上表现出色,虽有不足,如速度慢、幻觉率较高,但提供多种 effort 等级,成本低,安全对齐性好。
Clawdbot 之后,我们离能规模化落地的 Agent 还差什么?
OpenClaw爆火,但在企业和商业环境中存在昂贵、不可控等问题。Monolith砺思资本技术沙龙探讨Agent规模化落地难题,指出需关注稳定性等指标,还分析了数据成本、训练速度、基础设施、状态管理等方面的困境与解决思路。