添加自动文件压缩的实现

This commit is contained in:
yun
2026-09-13 21:53:37 +08:00
parent ab11fa71a0
commit 316c6420a7
21 changed files with 2037 additions and 66 deletions
+90 -11
View File
@@ -24,11 +24,16 @@ func (l *Logger) write(event string, b []byte) (n int, err error) {
// 必须满足 io.Writer 契约:成功时 n == len(b),否则调用方(log / io.MultiWriter
// 会认为发生了短写并把日志吞掉
func (l *Logger) store(event string, b []byte) (n int, err error) {
return l.storeTo(l.channel, event, b)
}
// storeTo 按指定 channel 落盘(异步消费协程用,它的 l.channel 是空的)
func (l *Logger) storeTo(channel, event string, b []byte) (n int, err error) {
if l.option.isPrintFile {
// 串行化写入:句柄缓冲区不是并发安全的,
// 异步消费协程与同步调用可能同时写同一个句柄
l.writeMu.Lock()
n, err = l.storeFile(event, b)
n, err = l.storeFileTo(channel, event, b)
l.writeMu.Unlock()
if err != nil {
return 0, err
@@ -43,11 +48,25 @@ func (l *Logger) store(event string, b []byte) (n int, err error) {
// storeFile 写入日志文件
func (l *Logger) storeFile(event string, b []byte) (int, error) {
f, err := l.getFile(event)
return l.storeFileTo(l.channel, event, b)
}
// storeFileTo 把日志写进指定 channel 对应的文件
func (l *Logger) storeFileTo(channel, event string, b []byte) (int, error) {
f, err := l.getFileTo(channel, event)
if err != nil {
return 0, err
}
// 按大小切割:这条日志会把当前文件写超上限时,先归档当前文件再换新文件
if limit := l.option.sizeSplit; limit > 0 && f.full(limit, len(b)) {
nf, rerr := l.rollFileTo(channel, event, f)
if rerr == nil {
f = nf
}
// 归档失败就继续往原文件写:宁可文件超一点,也不能把日志丢了
}
n, err := f.Write(b)
if err == nil && n < len(b) {
err = io.ErrShortWrite
@@ -58,8 +77,8 @@ func (l *Logger) storeFile(event string, b []byte) (int, error) {
// 写入失败:丢弃这个句柄,落到磁盘后按最新文件名重开一次再写
// 只重试一次,避免原实现在短写时反复重开文件
l.discardFile(event, f)
if nf, nerr := l.getFile(event); nerr == nil {
l.discardFileTo(channel, event, f)
if nf, nerr := l.getFileTo(channel, event); nerr == nil {
if n2, err2 := nf.Write(b); err2 == nil && n2 == len(b) {
return n2, nil
}
@@ -68,6 +87,43 @@ func (l *Logger) storeFile(event string, b []byte) (int, error) {
return 0, err
}
// rollFileTo 归档当前文件并返回新文件句柄
func (l *Logger) rollFileTo(channel, event string, f *logFile) (*logFile, error) {
key := fileKey{channel: channel, event: event}
// 先把缓冲清空再关句柄,保证归档内容完整
if err := f.Close(); err != nil {
return nil, err
}
// 归档基名直接用句柄记下的 baseName:绝不去猜文件名尾部的 _N 是不是归档序号
// (按小时切割出来的名字本身就长这样:2026/09/13/06_info.log
path, err := l.archive(f.baseName, f.fileName)
if err != nil {
return nil, err
}
l.mu.Lock()
if cur, ok := l.filePath[key]; ok && cur == f {
delete(l.filePath, key)
}
l.mu.Unlock()
// 新文件带走递增序号,避免覆盖刚归档出去的同名文件
nf, err := l.openNumberedFile(key, l.nextIndex())
if err != nil {
return nil, err
}
l.mu.Lock()
l.filePath[key] = nf
l.mu.Unlock()
// 后台压缩,不阻塞写入
l.scheduleCompress(path)
return nf, nil
}
// 写入额外的驱动(控制台 / 自定义 writer)
func (l *Logger) writeDrivers(b []byte) (int, error) {
if len(l.option.drivers) == 0 {
@@ -78,20 +134,29 @@ func (l *Logger) writeDrivers(b []byte) (int, error) {
// discardFile 关闭文件并从缓存中移除,使下次写入重新打开
func (l *Logger) discardFile(event string, f *logFile) {
l.discardFileTo(l.channel, event, f)
}
// discardFileTo 关闭并移除指定 channel 的文件句柄
func (l *Logger) discardFileTo(channel, event string, f *logFile) {
_ = f.Close()
l.mu.Lock()
defer l.mu.Unlock()
key := fileKey{channel: l.channel, event: event}
key := fileKey{channel: channel, event: event}
if cur, ok := l.filePath[key]; ok && cur == f {
delete(l.filePath, key)
}
}
// 异步队列的任务
// Channel 必须跟着任务走:消费协程持有的是「创建队列时的那个 logger」,
// 它的 channel 是空的。如果消费时用 logger 自己的 channel
// 所有 channel 的日志都会落进根目录文件(曾经就是这么错的)
type cacheData struct {
Event string
Data []byte
Channel string
Event string
Data []byte
}
// toAsync 尝试异步写入
@@ -105,11 +170,13 @@ func (l *Logger) toAsync(event string, b []byte) bool {
// 整段「检查开关 + 入队」都在同一把锁内:Close 也拿这把锁来停止投递,
// 这样 Close 拿到锁时就能确定「要么这条还没入队、要么已经完整入队」。
// 否则消费协程可能先看到空队列就退出,把还在路上的这条日志整条丢掉。
//
// wg 用来告诉 drainAsync「投递临界区里还有人」:Close 必须等这些写入
// 真正入队之后才能关闭队列,否则向已关闭的 channel 发送会 panic。
// 队列满时这里会阻塞,但消费者是独立 goroutine 且不需要这把锁,不会死锁
l.async.mu.Lock()
defer l.async.mu.Unlock()
if l.async.closed {
l.async.mu.Unlock()
// 已开始关闭:退化为同步写入
return false
}
@@ -117,7 +184,13 @@ func (l *Logger) toAsync(event string, b []byte) bool {
l.async.ch = make(chan cacheData, asyncQueueSize)
go l.asyncWorker(l.async.ch)
}
l.async.ch <- cacheData{Event: event, Data: b}
l.async.begin()
ch := l.async.ch
l.async.mu.Unlock()
defer l.async.end() // 必须在解锁之后 Done,保证 begin/end 覆盖整段投递
ch <- cacheData{Channel: l.channel, Event: event, Data: b}
return true
}
@@ -130,7 +203,8 @@ func (l *Logger) asyncWorker(q chan cacheData) {
}
}()
for val := range q {
_, _ = l.store(val.Event, val.Data)
// 按任务里记的 channel 落盘,避免多个 channel 的日志混到根目录
_, _ = l.storeTo(val.Channel, val.Event, val.Data)
}
}
@@ -147,6 +221,11 @@ func (l *Logger) drainAsync() {
return
}
// 关键:必须等「已经进入投递临界区」的写入全部入队之后才能关队列。
// 这里能看到 wg 已经是 0,就说明没有写入还卡在投递路径上,
// 否则 close(q) 之后它们再发就会 panic: send on closed channel
l.async.wg.Wait()
// 关闭队列并等消费者把缓冲里的任务全部处理完。
// 这一步必须真的等到 workerDone:否则 Close 会在消费协程还在写缓冲时
// 就刷盘并关闭文件,最后几条日志会连着句柄一起丢掉