最新国产好看的视频,伊人天堂AV在线,国产Aaaaaa视频,蜜臀视频在线观看一区,人妻av色图,密臀久久久精品影片,青青视频免费观看毛片,久草在线观看视,国产三级精品色情在线

Golang?統(tǒng)計字符串中數字字母數量的實現方法

 更新時間:2022年06月01日 11:01:06   作者:戀喵大鯉魚  
這篇文章主要介紹了Golang?統(tǒng)計字符串中數字字母數量,本文給出了兩種從字符串獲取數字與字母數量的方法,分別是ASCII 碼值和正則表達式,需要的朋友可以參考下

1.需求說明

記錄一下項目對用戶 UGC 文本進行字數限制的具體實現。

不同的產品,出于種種原因,一般都會對用戶輸入的文本內容做字數限制。

  • 出于產品定位,比如 140 字符限制的 Twitter,讓內容保持簡潔凝練,易于閱讀;
  • 出于用戶的閱讀體驗,過多的文字會造成閱讀疲勞,合適的字數能夠提高閱讀舒適度;
  • 出于技術與成本的考慮,不設上限的 UGC 內容會引發(fā)一些潛在的問題,比如增加存儲的成本,降低檢索效率等。

回到自己的項目,是一個用戶發(fā)帖的業(yè)務場景。產品同學給到的要求是:

  • 帖子名稱,限制在 25 個字;
  • 帖子正文,限制在 1500 字;
  • 關于字的說明:1 個漢字為一個字,一個 Emoji 表情相當于 1 個字,2 個數字/英文字母相當于 1 個字。

正常情況下,漢字,Emoji 字符,數字與英文字母都是單獨的字符。這里 2 個數字/英文算作 1 個字,所以在計算字符串長度時,不能夠使用 []rune 強轉后來獲取其長度,而是需要統(tǒng)計出數字與英文字母的數量,再加上其他字符數量,作為其長度。所以,要想實現產品同學的要求,關鍵是需要統(tǒng)計出用戶輸入文本中的數字與英文字母的數量。

2.實現

在 Golang,一般有兩種方法。

2.1 ASCII 碼值法

數字和英文字母的 ASCII 碼值我們是知道的,通過對原字符串遍歷,便可統(tǒng)計出數字/英文字母的數量。

// GetAlphanumericNumByASCII 根據 ASCII 碼值獲取字母數字數量。
func GetAlphanumericNumByASCII(s string) int {
	num := int(0)
	for i := 0; i < len(s); i++ {
		switch {
		case 48 <= s[i] && s[i] <= 57: // 數字
			fallthrough
		case 65 <= s[i] && s[i] <= 90: // 大寫字母
			fallthrough
		case 97 <= s[i] && s[i] <= 122: // 小寫字母
			num++
		default:
		}
	}
	return num
}

// 或者
// GetAlphanumericNumByASCIIV2 根據 ASCII 碼值獲取字母數字數量。
func GetAlphanumericNumByASCIIV2(s string) int {
	num := int(0)
	for _, c := range s {
		switch {
		case '0' <= c && c <= '9':
			fallthrough
		case 'a' <= c && c <= 'z':
			fallthrough
		case 'A' <= c && c <= 'Z':
			num++
		default:
		}
	}
	return num
}

2.2 正則表達式

我們可以利用 Golang 標準庫包 regexp 獲取指定表達式的字串數量。

// GetAlphanumericNumByRegExp 根據正則表達式獲取字母數字數量。
func GetAlphanumericNumByRegExp(s string) int {
	rNum := regexp.MustCompile(`\d`)
	rLetter := regexp.MustCompile("[a-zA-Z]")
	return len(rNum.FindAllString(s, -1)) + len(rLetter.FindAllString(s, -1))
}

我們可以寫個單測來驗證下上面三個函數的正確性。

package string
import "testing"
func TestGetAlphanumericNumByASCII(t *testing.T) {
	type args struct {
		s string
	}
	tests := []struct {
		name string
		args args
		want int
	}{
		{
			name: "包含數字",
			args: args{"108條梁山好漢"},
			want: 3,
		},
		{
			name: "包含字母",
			args: args{"一百條梁山man"},
			want: 3,
		},
		{
			name: "包含數字與字母",
			args: args{"108條梁山man"},
			want: 6,
		},
	}
	for _, tt := range tests {
		t.Run(tt.name, func(t *testing.T) {
			if got := GetAlphanumericNumByASCII(tt.args.s); got != tt.want {
				t.Errorf("GetAlphanumericNumByASCII() = %v, want %v", got, tt.want)
			}
		})
	}
}
func TestGetAlphanumericNumByASCIIV2(t *testing.T) {
	type args struct {
		s string
	}
	tests := []struct {
		name string
		args args
		want int
	}{
		{
			name: "包含數字",
			args: args{"108條梁山好漢"},
			want: 3,
		},
		{
			name: "包含字母",
			args: args{"一百條梁山man"},
			want: 3,
		},
		{
			name: "包含數字與字母",
			args: args{"108條梁山man"},
			want: 6,
		},
	}
	for _, tt := range tests {
		t.Run(tt.name, func(t *testing.T) {
			if got := GetAlphanumericNumByASCIIV2(tt.args.s); got != tt.want {
				t.Errorf("GetAlphanumericNumByASCII() = %v, want %v", got, tt.want)
			}
		})
	}
}
func TestGetAlphanumericNumByRegExp(t *testing.T) {
	type args struct {
		s string
	}
	tests := []struct {
		name string
		args args
		want int
	}{
		{
			name: "包含數字",
			args: args{"108條梁山好漢"},
			want: 3,
		},
		{
			name: "包含字母",
			args: args{"一百條梁山man"},
			want: 3,
		},
		{
			name: "包含數字與字母",
			args: args{"108條梁山man"},
			want: 6,
		},
	}
	for _, tt := range tests {
		t.Run(tt.name, func(t *testing.T) {
			if got := GetAlphanumericNumByRegExp(tt.args.s); got != tt.want {
				t.Errorf("GetAlphanumericNumByRegExp() = %v, want %v", got, tt.want)
			}
		})
	}
}

運行go test main/string命令,其中 main/string 為單元測試所在包的路徑。輸出如下:

ok      main/string     0.355s

驗證無誤。

3.性能對比

上面提到的兩種方法都可以用來獲取字符串中數字與英文字母的數量,那么我們應該采用哪一種方法呢?

功能上沒有差別,那么我們來看下性能對比吧。

func BenchmarkGetAlphanumericNumByASCII(b *testing.B) {
	for n := 0; n < b.N; n++ {
		GetAlphanumericNumByASCII("108條梁山man")
	}
}
func BenchmarkGetAlphanumericNumByASCIIV2(b *testing.B) {
	for n := 0; n < b.N; n++ {
		GetAlphanumericNumByASCIIV2("108條梁山man")
	}
}
func BenchmarkGetAlphanumericNumByRegExp(b *testing.B) {
	for n := 0; n < b.N; n++ {
		GetAlphanumericNumByRegExp("108條梁山man")
	}
}

運行上面的基準測試,輸出如下:

go test -bench=. -benchmem main/string

goos: windows
goarch: amd64
pkg: main/string
cpu: Intel(R) Core(TM) i7-9700 CPU @ 3.00GHz
BenchmarkGetAlphanumericNumByASCII-8            89540210                12.67 ns/op            0 B/op          0 allocs/op
BenchmarkGetAlphanumericNumByASCIIV2-8          63227778                19.11 ns/op            0 B/op          0 allocs/op
BenchmarkGetAlphanumericNumByRegExp-8             465954              2430 ns/op            1907 B/op         27 allocs/op
PASS
ok      main/string     3.965s

不測不知道,一測嚇一跳。通過正則表達式的實現方式,代碼雖然簡潔,但是涉及多次內存配分,性能與 ASCII 碼值法相比,差距非常之大,是 ASCII 碼值法的 200 倍左右。所以從性能的考慮,推薦使用 ASCII 碼值的方式獲取數字字母數量。

ASCII 碼值法有兩種遍歷方式,一種是按照字節(jié)遍歷,一種是按照 rune 字符遍歷。因為后者涉及 rune 字符的判斷,所以性能會差一些。推薦使用按照字節(jié)遍歷。

4.小結

本文給出了兩種從字符串獲取數字與字母數量的方法:

  • ASCII 碼值。
  • 正則表達式。

出于性能的考慮,推薦使用 ASCII 碼值法,并使用字節(jié)遍歷的方式。

此外,本文給出的兩種方法,三種實現方式,相關源碼已放置開源庫 go-huge-util,可 import 直接使用。

package main
import (
	"fmt"
	huge "github.com/dablelv/go-huge-util"
)
func main() {
	fmt.Println(huge.GetAlphanumericNumByASCII("108條梁山man"))  	// 6
	fmt.Println(huge.GetAlphanumericNumByASCIIV2("108條梁山man"))  	// 6
	fmt.Println(huge.GetAlphanumericNumByRegExp("108條梁山man")) 	// 6
}

參考文獻

golang統(tǒng)計出其中英文字母、空格、數字和其它字符的個數

到此這篇關于Golang 統(tǒng)計字符串中數字字母數量的文章就介紹到這了,更多相關Golang 統(tǒng)計字符串內容請搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關文章希望大家以后多多支持腳本之家!

相關文章

  • Go語言中ORM框架GORM使用介紹

    Go語言中ORM框架GORM使用介紹

    GORM是Go語言中最受歡迎的ORM庫之一,它提供了強大的功能和簡潔的?API,讓數據庫操作變得更加簡單和易維護,本文將詳細介紹GORM的常見用法,包括數據庫連接、模型定義、CRUD、事務管理等方面,幫助大家快速上手使用GORM進行Web后端開發(fā)
    2023-06-06
  • 淺談Go Slice 高級實踐

    淺談Go Slice 高級實踐

    這篇文章主要介紹了淺談Go Slice 高級實踐,小編覺得挺不錯的,現在分享給大家,也給大家做個參考。一起跟隨小編過來看看吧
    2018-08-08
  • Go語言中的if條件語句使用詳解

    Go語言中的if條件語句使用詳解

    這篇文章主要介紹了Go語言中的if條件語句的使用,包括if...else語句以及相關嵌套,需要的朋友可以參考下
    2015-10-10
  • 從并發(fā)到并行解析Go語言中的sync.WaitGroup

    從并發(fā)到并行解析Go語言中的sync.WaitGroup

    Go?語言提供了許多工具和機制來實現并發(fā)編程,其中之一就是?sync.WaitGroup。本文就來深入討論?sync.WaitGroup,探索其工作原理和在實際應用中的使用方法吧
    2023-05-05
  • 詳解Go并發(fā)編程時如何避免發(fā)生競態(tài)條件和數據競爭

    詳解Go并發(fā)編程時如何避免發(fā)生競態(tài)條件和數據競爭

    大家都知道,Go是一種支持并發(fā)編程的編程語言,但并發(fā)編程也是比較復雜和容易出錯的。比如本篇分享的問題:競態(tài)條件和數據競爭的問題
    2023-04-04
  • Go語言實現配置熱加載的方法分享

    Go語言實現配置熱加載的方法分享

    web項目,經常需要熱啟動各種各樣的配置信息,一旦這些服務發(fā)生變更,我們需要重新啟動web server,以使配置生效,實現配置熱加載,本文為大家整理了幾個方法實現這個需求,需要的可以參考下
    2023-05-05
  • go語言計算兩個時間的時間差方法

    go語言計算兩個時間的時間差方法

    這篇文章主要介紹了go語言計算兩個時間的時間差方法,涉及Python操作時間的技巧,需要的朋友可以參考下
    2015-03-03
  • go語言的初始化順序,包,變量,init詳解

    go語言的初始化順序,包,變量,init詳解

    這篇文章主要介紹了go語言的初始化順序,包,變量,init詳解,具有很好的參考價值,希望對大家有所幫助。一起跟隨小編過來看看吧
    2020-12-12
  • go項目中環(huán)境變量的配置

    go項目中環(huán)境變量的配置

    本文主要介紹了go項目中環(huán)境變量的配置,文中通過示例代碼介紹的非常詳細,需要的朋友們下面隨著小編來一起學習學習吧
    2021-07-07
  • Golang無限緩存channel的設計與實現解析

    Golang無限緩存channel的設計與實現解析

    這篇文章主要為大家介紹了Golang無限緩存channel的設計與實現解析,有需要的朋友可以借鑒參考下,希望能夠有所幫助,祝大家多多進步,早日升職加薪
    2023-07-07

最新評論

桂林市| 乌什县| 昌平区| 炉霍县| 海淀区| 四会市| 西乌珠穆沁旗| 襄城县| 永顺县| 永昌县| 崇礼县| 伊宁市| 台江县| 来宾市| 大渡口区| 巫山县| 泰兴市| 临潭县| 营山县| 白城市| 晋城| 奈曼旗| 大冶市| 西平县| 甘孜| 昭通市| 晋江市| 灵台县| 建瓯市| 利津县| 吴旗县| 武冈市| 宁德市| 新田县| 宝坻区| 东乡族自治县| 昭通市| 修文县| 清水县| 沽源县| 肇州县|