「适配场景」共找到 2185 篇相关文章
Luma Uni-1.1 API开放,图像模型榜单第三,文字渲染直逼GPT image 2
今年图像生成模型迭代快,海外AI初创公司Luma将统一图像模型Uni - 1升级到1.1版并开放API。它在榜单排名前三,价格与延迟低,有诸多品牌客户接入。展示了多场景应用效果,技术路线独特,定价有优势。
在「外滩大会·具身智能:从泛化到行动,重塑产业未来」上,这些大牛都说了什么?
9月11日,机器之心联合出品的外滩大会见解论坛聚焦具身智能。多位学界和业界代表分享看法,如孙富春称训练场可破数据瓶颈,江磊指其是新型数据工厂。思辨和圆桌环节探讨技术路线、应用场景等关键问题。
回归C++: 在GGUF上构建高效的向量模型
Jina AI分享将纯解码器向量模型适配到GGUF格式及在llama.cpp工具链的优化经验。经处理得到特定任务v4模型,还生成量化版本并上传。介绍使用方法、注意事项,经测试推荐IQ3_S或IQ3_M版配合定制工具。
“通用大模型微调成为行业模型是伪命题”?医疗AI深度重构,传神语联创始人何恩培:孪生智能体能砍70%线下复诊工作
本文为《2025 年度盘点与趋势洞察》系列访谈,传神语联创始人何恩培分享医疗 AI 发展看法。他认为通用大模型微调成行业模型是伪命题,介绍了传神素问中医大模型应用,还对比中西医 AI 化差异,探讨未来发展场景与挑战。
MCP for 可观测2.0,6个让MCP开发更高效的小妙招
文章介绍MCP这一开放协议,它能标准化AI模型与不同数据源和工具连接。分享配置MCP开发所需客户端、API等步骤,阐述阿里云可观测2.0融合MCP的实践及效果,还给出设计MCP Server的6个经验,最后展望了MCP应用场景和可观测2.0+AI未来。
FlashAttention 完全进化史:FA-4 发布之际的技术全景回顾
文章围绕FlashAttention展开,从Attention性能瓶颈引出问题,阐述其各版本演进。FA-1实现算法突破,避免O(N²)内存;FA-2适配架构,提升性能;FA-3深度协同,实现异步;FA-4探索更深异步和角色分工。还探讨跨芯片迁移及未来优化方向。
大基金或将领投DeepSeek?算力拐点将至
5月6日报道国家大基金正洽谈领投DeepSeek首轮融资,估值约450亿美元。大基金此前未公开投资大模型公司,此次若落地是从“半导体硬件”向“AI应用端”延伸。2025年是中国AI芯片出货量关键年份,DeepSeek-V4发布,多家国产芯片品牌完成适配,但国产芯片仍面临性能、软件生态等挑战。
连续发布两款万亿参数模型,蚂蚁 AI 来势汹汹
国庆期间大模型行业热闹非凡,各团队产品侧重不同。蚂蚁百灵大模型团队在十天内连续发布并开源两款万亿参数模型 Ling-1T 和 Ring-1T-preview,引发关注。万亿参数模型难训,国内达到此规模的屈指可数。Ling-1T 综合性能出色,应用场景广泛。蚂蚁选择开源,意在构建开放 AGI 生态。
ElevenLabs 发布“视频到音乐”:AI 读懂视频内容,为其创作氛围匹配的 BGM。
ElevenLabs推出“视频到音乐”功能,其“Eleven Music”模型能分析视频上下文、情绪和风格,一键生成匹配的定制背景音乐,还能添加画外音和音效,为创作者提供端到端音视频解决方案。
codex负责人:codex就要过时了
Codex负责人称两三个月后Codex将过时,因下一代模型要处理大规模并发Agent,非其能应对。Huggingface实验显示大小模型在不同harness下排名差异大,脱离模型谈harness过时或不适配说模型Agent能力都不妥。