京算Token工厂七大核心能力亮相。 ■记者 周宇杰/摄
作为本届服贸会核心特色展区,“数字友好解决方案”展在3号馆ICT专题展亮相。北京市聚焦软件、医药、网络安全及信息通信四大优势行业,依托海淀区、北京经济技术开发区、朝阳区、西城区等产业集聚高地,持续推动“模数共振”行动。
作为“模数共振”北京方案的代表企业,北京数据集团由旗下智能院集团牵头,联合北京数据先行区服务有限公司(以下简称“京数公司”)、北京国际算力服务有限公司(以下简称“京算公司”)、北京国际数据跨境服务有限公司(以下简称“数跨公司”)协同打造的“模数共振”北京方案正式亮相。
“模数共振”北京方案以应用为牵引、模型为驱动、数据为核心、算力为支撑,将数据开发加工、算力供给、模型训练推理、跨境合规与安全传输构建统一服务架构,着力解决行业数据获取难、算力使用成本高、产品出海合规难等问题。
筑牢“模数共振”数据基座
作为“模数共振”方案中数据底座的核心承载主体,京数公司在本次服贸会上重点展示了三大核心能力:全国首个行业数据赋能工厂——北京人工智能数据应用开发平台,推动数据加工实现从“小作坊”到“大工厂”的转型;汇聚链接覆盖医药健康、具身智能等行业的高质量数据集资源池;推出面向医药健康行业的自研产品“MeDatAI觅数引擎”,构建安全可信的“模数共振”空间,促进通用大模型、医疗数据、高性能算力融合,以场景应用为导向,面向医疗机构、模型企业、药企等提供“开箱即用”的AI服务,助力北京人工智能+医药健康产业高质量发展。
北京人工智能数据应用开发平台是全国首个行业数据赋能工厂,也是行业数据价值体系的“生产底座”。平台打通汇聚、治理、标注、评测、应用全链条,依托沙盒机制保障合规安全,构建“生产工艺”级数据开发流水线,实现从“原材料”到“成品数据集”的工业化生产闭环。正是基于这一底座能力,京数公司可规模化、标准化生产高质量数据资产,为行业应用提供原料保障。
依托平台工业化生产能力,京数公司已汇聚链接上千个高质量数据集,重点覆盖医药健康、具身智能、语音视频等领域。同时,立足北京区位、产业、人才优势,构建“北京专家级,京外通用级”数据采集标注服务体系,联合各行业垂类数商开展合作,为人工智能企业提供优质高效、低成本的数据服务。
作为“模数共振”北京方案的重点行业应用方向,京数公司依托上述平台底座及服务能力,自研“MeDatAI觅数引擎”核心产品,内置数据分级分类体系、K值匿名化策略、网络及数据安全技术,实现医疗高质量数据集的合规化汇聚、标准化加工、规模化生产,破解医疗数据获取难、开发难的问题。同时,提供智能体低代码开发、合规准入、统一接口、全周期监控能力,支持医疗AI生态产品高效接入与院内轻量化部署。依托自建高性能算力底座,结合数据动态匿名化工具,为医疗机构和医生提供安全可信的推理服务,构建“专家数据+通用词元”融合的医疗数据价值化新范式。
打造首都算力创新高地
数据经过治理与标注形成高质量数据集之后,还需要充足算力支撑模型训练和推理应用,才能真正转化为生产力。作为“模数共振”北京方案的核心资源,京算公司国资词元工厂目前已取得阶段性突破,构建起“京算(算力及推理创新引擎)、京芯(国产芯片价值重塑)、京模(政策与模型双重加持)、京用(国资信用与落地应用)”完整业务体系,为北京市首创。
针对算力行业供给不足、成本高昂、效率偏低等痛点,京算词元工厂打造全模型覆盖、多场景适配的一站式高性价比算力解决方案。依托PD分离智能调度架构与全栈推理加速框架,异构算力池化调度将资源利用率从行业普遍的30%—40%提升至80%以上。与传统“卖硬件”模式不同,工厂直接交付标准化词元和API成品能力,客户按实际消耗量付费、零门槛接入,无需自建运维团队,综合使用成本大幅降低。
项目依托北京毫秒级低时延响应优势,累计服务超100家企业客户,承接多个市委办局专属大模型训练项目,规模和服务能力在全国国资词元项目中处于领先地位。目前日产词元超100亿个,未来预计产能可跃升至千亿级至万亿级。
全链条数据跨境合规服务
作为“模数共振”北京方案跨境合规与安全传输的核心支撑,北京国际数据跨境服务有限公司可为相关企业提供咨询、场景研判、风险整改、合规申报、韧性治理全流程合规服务,涵盖数据出境安全评估、数据出境负面清单备案、个人信息数据出境标准合同备案等核心业务。
面对AI时代数据跨境合规新挑战,例如词元化重塑数据识别逻辑、智能体互联实现数据跨境“无感化”、具身智能打开“真实世界数据”魔盒等,数跨公司依托“数联网”架构构建跨境可信数据空间,实现数据不搬家、用途可约束、过程可追溯。同时,依托北京人工智能数据训练基地算网集群打造“E数通”跨境链路,搭建跨境网络节点,提供点对点安全传输、复杂场景定制互联及海外上云服务。
发表评论 取消回复