降本」共找到 583 篇相关文章

新闻资讯7

裁4000人换来的AI全白搞?Salesforce悄悄改架构:用 “老技术”故障少还省钱,网友怒喊:CEO零遣散费滚蛋

Salesforce曾大举部署AI并裁员,宣称Agentforce能降本。但如今高管称不过度依赖大模型时运行更好,已引入基础自动化技术。其应用遇瓶颈,故障频发、成高,还面临AI“漂移”等问题。

AI前线
新闻资讯7

包云岗:不止步于原位替代ARM,开源是RISC-V破局的关键

在全球半导体产业格局重构背景下,RISC-V从边缘走向核心。第五届RISC-V中国峰会举办,包云岗分享其产业应用观察。虽前景好,但RISC-V面临诸多问题,他认为开源是破局关键,还介绍了案例和香山项目。

芯师爷
开源动态8

英伟达MIT出手!华人团队重磅开源,大模型推理内存暴10倍

英伟达、MIT、浙大华人研究者联合推出TriAttention,核心是在pre - RoPE空间用Q/K三角集中度估计KV token重要性,保留关键部分。它使内存消耗10倍,吞吐量提2.5倍,还提供vLLM集成和MLX实验性支持。

新智元
算法论文8

总成低30倍,告别昂贵后训练,在线策略蒸馏敲开大模型后训练的未来

明星公司Thinking Machines由前OpenAI首席技术官联合创立,其研究团队提出在线策略蒸馏的LLM后训练方法。该方法结合在线策略训练与蒸馏优势,解决后训练两难困境,成30倍,还为持续学习和个性化打开新大门。

AIGC开放社区
新闻资讯8

训练数据量低1万倍,谷歌提出超高质量数据主动学习方法

将大模型应用于特定领域需数据微调,但筛选高保真训练数据难度大、成高。谷歌提出新主动学习筛选流程,能将训练数据规模1万倍,还提升模型与人类专家一致性。经实验验证,该方法效果显著。

AIGC开放社区
新闻资讯7

用AI,写代码只会更慢!但一定更「快乐」

METR研究实测发现,GPT等AI编程工具让顶尖程序员写代码平均慢19%,效率不升反。开发者预计提效24%,体验后仍觉快20%。研究还分析变慢原因,提醒勿高估AI编程能力。

新智元
产品应用8

豆包 Seed 2.0 Lite升级:给 Agent 装上眼睛和耳朵

近期模型发布竞争激烈,作者做视频字幕常遇识别错误,因语音识别工具缺上下文。字节方舟的豆包 Seed 2.0 Lite 升级后能听,还可结合上下文准确输出字幕,成 20%,也能理解视频,为工作流补全感知。

花叔
新闻资讯8

19岁少年用计算机炼出「神药」,斩获全球大奖!大厂看了都沉默

19岁斯洛伐克少年Adam Kovalčík用计算机模拟设计新分子,提出新合成方法,有望将抗RNA病毒药物Galidesivir成6倍,还设计出对新冠抑制效果或达Galidesivir 5倍的新分子,获全球青少年科研大奖。

新智元
新闻资讯7

AI算力大战打到太空!英伟达前脚H100入轨,谷歌TPU后脚上天,中国玩家笑而不语

英伟达和谷歌在太空算力布局上竞争激烈,英伟达H100已入轨,谷歌TPU预计2027年初上天,二者都想建吉瓦级数据中心。太空部署有成、散热等优势,但也有工程挑战,而中国之江实验室星座已商用。

量子位
新闻资讯8

Cursor 套壳、Cloudflare 上架、老黄邀请,中国模型杀进了硅谷的 AI 供应链

3月19日,Cursor发布新模型Composer 2,后被发现底层基于中国Kimi开源模型K2.5微调。此外,Cloudflare将K2.5上架到边缘计算平台,成77%;黄仁勋邀Kimi创始人演讲;马斯克两度点赞Kimi。

Founder Park