authorgravatar for andrew@ziglang.orgAndrew Kelley <andrew@ziglang.org> 2025-07-30 19:02:00-07:00
committergravatar for andrew@ziglang.orgAndrew Kelley <andrew@ziglang.org> 2025-07-31 22:10:11-07:00
logc49c90a42af225f6f125c1bedd0b3cb423de2b4d
tree3aa6bd9bdfe609eb3a38a6f3f944965915979fc6
parent4c04835a08097d18a30ba74ef9a3aa59f3b90fd3

fetch: update API usage


5 files changed, 227 insertions(+), 207 deletions(-)

lib/std/Io/Reader.zig+30-19
......@@ -74,6 +74,10 @@ pub const VTable = struct {
7474 ///
7575 /// `data` may not contain an alias to `Reader.buffer`.
7676 ///
77 /// `data` is mutable because the implementation may to temporarily modify
78 /// the fields in order to handle partial reads. Implementations must
79 /// restore the original value before returning.
80 ///
7781 /// Implementations may ignore `data`, writing directly to `Reader.buffer`,
7882 /// modifying `seek` and `end` accordingly, and returning 0 from this
7983 /// function. Implementations are encouraged to take advantage of this if
......@@ -81,7 +85,7 @@ pub const VTable = struct {
8185 ///
8286 /// The default implementation calls `stream` with either `data[0]` or
8387 /// `Reader.buffer`, whichever is bigger.
84 readVec: *const fn (r: *Reader, data: []const []u8) Error!usize = defaultReadVec,
88 readVec: *const fn (r: *Reader, data: [][]u8) Error!usize = defaultReadVec,
8589
8690 /// Ensures `capacity` more data can be buffered without rebasing.
8791 ///
......@@ -446,8 +450,8 @@ pub fn bufferedLen(r: *const Reader) usize {
446450 return r.end - r.seek;
447451}
448452
449pub fn hashed(r: *Reader, hasher: anytype) Hashed(@TypeOf(hasher)) {
450 return .{ .in = r, .hasher = hasher };
453pub fn hashed(r: *Reader, hasher: anytype, buffer: []u8) Hashed(@TypeOf(hasher)) {
454 return .init(r, hasher, buffer);
451455}
452456
453457pub fn readVecAll(r: *Reader, data: [][]u8) Error!void {
......@@ -1764,15 +1768,16 @@ pub fn Hashed(comptime Hasher: type) type {
17641768 return struct {
17651769 in: *Reader,
17661770 hasher: Hasher,
1767 interface: Reader,
1771 reader: Reader,
17681772
17691773 pub fn init(in: *Reader, hasher: Hasher, buffer: []u8) @This() {
17701774 return .{
17711775 .in = in,
17721776 .hasher = hasher,
1773 .interface = .{
1777 .reader = .{
17741778 .vtable = &.{
1775 .read = @This().read,
1779 .stream = @This().stream,
1780 .readVec = @This().readVec,
17761781 .discard = @This().discard,
17771782 },
17781783 .buffer = buffer,
......@@ -1782,33 +1787,39 @@ pub fn Hashed(comptime Hasher: type) type {
17821787 };
17831788 }
17841789
1785 fn read(r: *Reader, w: *Writer, limit: Limit) StreamError!usize {
1786 const this: *@This() = @alignCast(@fieldParentPtr("interface", r));
1787 const data = w.writableVector(limit);
1790 fn stream(r: *Reader, w: *Writer, limit: Limit) StreamError!usize {
1791 const this: *@This() = @alignCast(@fieldParentPtr("reader", r));
1792 const data = limit.slice(try w.writableSliceGreedy(1));
1793 var vec: [1][]u8 = .{data};
1794 const n = try this.in.readVec(&vec);
1795 this.hasher.update(data[0..n]);
1796 w.advance(n);
1797 return n;
1798 }
1799
1800 fn readVec(r: *Reader, data: [][]u8) Error!usize {
1801 const this: *@This() = @alignCast(@fieldParentPtr("reader", r));
17881802 const n = try this.in.readVec(data);
1789 const result = w.advanceVector(n);
17901803 var remaining: usize = n;
17911804 for (data) |slice| {
17921805 if (remaining < slice.len) {
17931806 this.hasher.update(slice[0..remaining]);
1794 return result;
1807 return n;
17951808 } else {
17961809 remaining -= slice.len;
17971810 this.hasher.update(slice);
17981811 }
17991812 }
18001813 assert(remaining == 0);
1801 return result;
1814 return n;
18021815 }
18031816
18041817 fn discard(r: *Reader, limit: Limit) Error!usize {
1805 const this: *@This() = @alignCast(@fieldParentPtr("interface", r));
1806 var w = this.hasher.writer(&.{});
1807 const n = this.in.stream(&w, limit) catch |err| switch (err) {
1808 error.WriteFailed => unreachable,
1809 else => |e| return e,
1810 };
1811 return n;
1818 const this: *@This() = @alignCast(@fieldParentPtr("reader", r));
1819 const peeked = limit.slice(try this.in.peekGreedy(1));
1820 this.hasher.update(peeked);
1821 this.in.toss(peeked.len);
1822 return peeked.len;
18121823 }
18131824 };
18141825}
lib/std/Io/Writer.zig+48
......@@ -2296,6 +2296,8 @@ pub fn fixedDrain(w: *Writer, data: []const []const u8, splat: usize) Error!usiz
22962296/// generic. A better solution will involve creating a writer for each hash
22972297/// function, where the splat buffer can be tailored to the hash implementation
22982298/// details.
2299///
2300/// Contrast with `Hashing` which terminates the stream pipeline.
22992301pub fn Hashed(comptime Hasher: type) type {
23002302 return struct {
23012303 out: *Writer,
......@@ -2368,6 +2370,52 @@ pub fn Hashed(comptime Hasher: type) type {
23682370 };
23692371}
23702372
2373/// Provides a `Writer` implementation based on calling `Hasher.update`,
2374/// discarding all data.
2375///
2376/// This implementation makes suboptimal buffering decisions due to being
2377/// generic. A better solution will involve creating a writer for each hash
2378/// function, where the splat buffer can be tailored to the hash implementation
2379/// details.
2380///
2381/// The total number of bytes written is stored in `hasher`.
2382///
2383/// Contrast with `Hashed` which also passes the data to an underlying stream.
2384pub fn Hashing(comptime Hasher: type) type {
2385 return struct {
2386 hasher: Hasher,
2387 writer: Writer,
2388
2389 pub fn init(buffer: []u8) @This() {
2390 return .initHasher(.init(.{}), buffer);
2391 }
2392
2393 pub fn initHasher(hasher: Hasher, buffer: []u8) @This() {
2394 return .{
2395 .hasher = hasher,
2396 .writer = .{
2397 .buffer = buffer,
2398 .vtable = &.{ .drain = @This().drain },
2399 },
2400 };
2401 }
2402
2403 fn drain(w: *Writer, data: []const []const u8, splat: usize) Error!usize {
2404 const this: *@This() = @alignCast(@fieldParentPtr("writer", w));
2405 const hasher = &this.hasher;
2406 hasher.update(w.buffered());
2407 w.end = 0;
2408 var n: usize = 0;
2409 for (data[0 .. data.len - 1]) |slice| {
2410 hasher.update(slice);
2411 n += slice.len;
2412 }
2413 for (0..splat) |_| hasher.update(data[data.len - 1]);
2414 return n + splat;
2415 }
2416 };
2417}
2418
23712419/// Maintains `Writer` state such that it writes to the unused capacity of an
23722420/// array list, filling it up completely before making a call through the
23732421/// vtable, causing a resize. Consequently, the same, optimized, non-generic
lib/std/net.zig+2-1
......@@ -1932,7 +1932,8 @@ pub const Stream = struct {
19321932
19331933 fn stream(io_r: *Io.Reader, io_w: *Io.Writer, limit: Io.Limit) Io.Reader.StreamError!usize {
19341934 const dest = limit.slice(try io_w.writableSliceGreedy(1));
1935 const n = try readVec(io_r, &.{dest});
1935 var bufs: [1][]u8 = .{dest};
1936 const n = try readVec(io_r, &bufs);
19361937 io_w.advance(n);
19371938 return n;
19381939 }
src/Package/Fetch.zig+6-4
......@@ -1394,18 +1394,20 @@ fn unpackGitPack(f: *Fetch, out_dir: fs.Dir, resource: *Resource.Git) anyerror!U
13941394
13951395 var index_file = try pack_dir.createFile("pkg.idx", .{ .read = true });
13961396 defer index_file.close();
1397 var index_file_buffer: [2000]u8 = undefined;
1398 var index_file_writer = index_file.writer(&index_file_buffer);
13971399 {
13981400 const index_prog_node = f.prog_node.start("Index pack", 0);
13991401 defer index_prog_node.end();
1400 var index_buffered_writer = std.io.bufferedWriter(index_file.deprecatedWriter());
1401 try git.indexPack(gpa, object_format, &pack_file_reader, index_buffered_writer.writer());
1402 try index_buffered_writer.flush();
1402 try git.indexPack(gpa, object_format, &pack_file_reader, &index_file_writer);
14031403 }
14041404
14051405 {
1406 var index_file_reader = index_file.reader(&index_file_buffer);
14061407 const checkout_prog_node = f.prog_node.start("Checkout", 0);
14071408 defer checkout_prog_node.end();
1408 var repository = try git.Repository.init(gpa, object_format, &pack_file_reader, index_file);
1409 var repository: git.Repository = undefined;
1410 try repository.init(gpa, object_format, &pack_file_reader, &index_file_reader);
14091411 defer repository.deinit();
14101412 var diagnostics: git.Diagnostics = .{ .allocator = arena };
14111413 try repository.checkout(out_dir, resource.want_oid, &diagnostics);
src/Package/Fetch/git.zig+141-183
......@@ -66,6 +66,33 @@ pub const Oid = union(Format) {
6666 }
6767 };
6868
69 const Hashing = union(Format) {
70 sha1: std.Io.Writer.Hashing(Sha1),
71 sha256: std.Io.Writer.Hashing(Sha256),
72
73 fn init(oid_format: Format, buffer: []u8) Hashing {
74 return switch (oid_format) {
75 .sha1 => .{ .sha1 = .init(buffer) },
76 .sha256 => .{ .sha256 = .init(buffer) },
77 };
78 }
79
80 fn writer(h: *@This()) *std.Io.Writer {
81 return switch (h.*) {
82 inline else => |*inner| &inner.writer,
83 };
84 }
85
86 fn final(h: *@This()) Oid {
87 switch (h.*) {
88 inline else => |*inner, tag| {
89 inner.writer.flush() catch unreachable; // hashers cannot fail
90 return @unionInit(Oid, @tagName(tag), inner.hasher.finalResult());
91 },
92 }
93 }
94 };
95
6996 pub fn fromBytes(oid_format: Format, bytes: []const u8) Oid {
7097 assert(bytes.len == oid_format.byteLength());
7198 return switch (oid_format) {
......@@ -73,9 +100,9 @@ pub const Oid = union(Format) {
73100 };
74101 }
75102
76 pub fn readBytes(oid_format: Format, reader: anytype) !Oid {
103 pub fn readBytes(oid_format: Format, reader: *std.Io.Reader) !Oid {
77104 return switch (oid_format) {
78 inline else => |tag| @unionInit(Oid, @tagName(tag), try reader.readBytesNoEof(tag.byteLength())),
105 inline else => |tag| @unionInit(Oid, @tagName(tag), (try reader.takeArray(tag.byteLength())).*),
79106 };
80107 }
81108
......@@ -166,8 +193,15 @@ pub const Diagnostics = struct {
166193pub const Repository = struct {
167194 odb: Odb,
168195
169 pub fn init(allocator: Allocator, format: Oid.Format, pack_file: *std.fs.File.Reader, index_file: std.fs.File) !Repository {
170 return .{ .odb = try Odb.init(allocator, format, pack_file, index_file) };
196 pub fn init(
197 repo: *Repository,
198 allocator: Allocator,
199 format: Oid.Format,
200 pack_file: *std.fs.File.Reader,
201 index_file: *std.fs.File.Reader,
202 ) !void {
203 repo.* = .{ .odb = undefined };
204 try repo.odb.init(allocator, format, pack_file, index_file);
171205 }
172206
173207 pub fn deinit(repository: *Repository) void {
......@@ -337,22 +371,28 @@ const Odb = struct {
337371 format: Oid.Format,
338372 pack_file: *std.fs.File.Reader,
339373 index_header: IndexHeader,
340 index_file: std.fs.File,
374 index_file: *std.fs.File.Reader,
341375 cache: ObjectCache = .{},
342376 allocator: Allocator,
343377
344378 /// Initializes the database from open pack and index files.
345 fn init(allocator: Allocator, format: Oid.Format, pack_file: *std.fs.File.Reader, index_file: std.fs.File) !Odb {
379 fn init(
380 odb: *Odb,
381 allocator: Allocator,
382 format: Oid.Format,
383 pack_file: *std.fs.File.Reader,
384 index_file: *std.fs.File.Reader,
385 ) !void {
346386 try pack_file.seekTo(0);
347387 try index_file.seekTo(0);
348 const index_header = try IndexHeader.read(index_file.deprecatedReader());
349 return .{
388 odb.* = .{
350389 .format = format,
351390 .pack_file = pack_file,
352 .index_header = index_header,
391 .index_header = undefined,
353392 .index_file = index_file,
354393 .allocator = allocator,
355394 };
395 try odb.index_header.read(&index_file.interface);
356396 }
357397
358398 fn deinit(odb: *Odb) void {
......@@ -369,7 +409,7 @@ const Odb = struct {
369409 const base_object = while (true) {
370410 if (odb.cache.get(base_offset)) |base_object| break base_object;
371411
372 base_header = try EntryHeader.read(odb.format, odb.pack_file.interface.adaptToOldInterface());
412 base_header = try EntryHeader.read(odb.format, &odb.pack_file.interface);
373413 switch (base_header) {
374414 .ofs_delta => |ofs_delta| {
375415 try delta_offsets.append(odb.allocator, base_offset);
......@@ -412,7 +452,7 @@ const Odb = struct {
412452 const found_index = while (start_index < end_index) {
413453 const mid_index = start_index + (end_index - start_index) / 2;
414454 try odb.index_file.seekTo(IndexHeader.size + mid_index * oid_length);
415 const mid_oid = try Oid.readBytes(odb.format, odb.index_file.deprecatedReader());
455 const mid_oid = try Oid.readBytes(odb.format, &odb.index_file.interface);
416456 switch (mem.order(u8, mid_oid.slice(), oid.slice())) {
417457 .lt => start_index = mid_index + 1,
418458 .gt => end_index = mid_index,
......@@ -423,12 +463,12 @@ const Odb = struct {
423463 const n_objects = odb.index_header.fan_out_table[255];
424464 const offset_values_start = IndexHeader.size + n_objects * (oid_length + 4);
425465 try odb.index_file.seekTo(offset_values_start + found_index * 4);
426 const l1_offset: packed struct { value: u31, big: bool } = @bitCast(try odb.index_file.deprecatedReader().readInt(u32, .big));
466 const l1_offset: packed struct { value: u31, big: bool } = @bitCast(try odb.index_file.interface.takeInt(u32, .big));
427467 const pack_offset = pack_offset: {
428468 if (l1_offset.big) {
429469 const l2_offset_values_start = offset_values_start + n_objects * 4;
430470 try odb.index_file.seekTo(l2_offset_values_start + l1_offset.value * 4);
431 break :pack_offset try odb.index_file.deprecatedReader().readInt(u64, .big);
471 break :pack_offset try odb.index_file.interface.takeInt(u64, .big);
432472 } else {
433473 break :pack_offset l1_offset.value;
434474 }
......@@ -1080,18 +1120,18 @@ const PackHeader = struct {
10801120 const signature = "PACK";
10811121 const supported_version = 2;
10821122
1083 fn read(reader: anytype) !PackHeader {
1084 const actual_signature = reader.readBytesNoEof(4) catch |e| switch (e) {
1123 fn read(reader: *std.Io.Reader) !PackHeader {
1124 const actual_signature = reader.take(4) catch |e| switch (e) {
10851125 error.EndOfStream => return error.InvalidHeader,
10861126 else => |other| return other,
10871127 };
1088 if (!mem.eql(u8, &actual_signature, signature)) return error.InvalidHeader;
1089 const version = reader.readInt(u32, .big) catch |e| switch (e) {
1128 if (!mem.eql(u8, actual_signature, signature)) return error.InvalidHeader;
1129 const version = reader.takeInt(u32, .big) catch |e| switch (e) {
10901130 error.EndOfStream => return error.InvalidHeader,
10911131 else => |other| return other,
10921132 };
10931133 if (version != supported_version) return error.UnsupportedVersion;
1094 const total_objects = reader.readInt(u32, .big) catch |e| switch (e) {
1134 const total_objects = reader.takeInt(u32, .big) catch |e| switch (e) {
10951135 error.EndOfStream => return error.InvalidHeader,
10961136 else => |other| return other,
10971137 };
......@@ -1143,13 +1183,13 @@ const EntryHeader = union(Type) {
11431183 };
11441184 }
11451185
1146 fn read(format: Oid.Format, reader: anytype) !EntryHeader {
1186 fn read(format: Oid.Format, reader: *std.Io.Reader) !EntryHeader {
11471187 const InitialByte = packed struct { len: u4, type: u3, has_next: bool };
1148 const initial: InitialByte = @bitCast(reader.readByte() catch |e| switch (e) {
1188 const initial: InitialByte = @bitCast(reader.takeByte() catch |e| switch (e) {
11491189 error.EndOfStream => return error.InvalidFormat,
11501190 else => |other| return other,
11511191 });
1152 const rest_len = if (initial.has_next) try readSizeVarInt(reader) else 0;
1192 const rest_len = if (initial.has_next) try reader.takeLeb128(u64) else 0;
11531193 var uncompressed_length: u64 = initial.len;
11541194 uncompressed_length |= std.math.shlExact(u64, rest_len, 4) catch return error.InvalidFormat;
11551195 const @"type" = std.enums.fromInt(EntryHeader.Type, initial.type) orelse return error.InvalidFormat;
......@@ -1172,25 +1212,12 @@ const EntryHeader = union(Type) {
11721212 }
11731213};
11741214
1175fn readSizeVarInt(r: anytype) !u64 {
1176 const Byte = packed struct { value: u7, has_next: bool };
1177 var b: Byte = @bitCast(try r.readByte());
1178 var value: u64 = b.value;
1179 var shift: u6 = 0;
1180 while (b.has_next) {
1181 b = @bitCast(try r.readByte());
1182 shift = std.math.add(u6, shift, 7) catch return error.InvalidFormat;
1183 value |= @as(u64, b.value) << shift;
1184 }
1185 return value;
1186}
1187
1188fn readOffsetVarInt(r: anytype) !u64 {
1215fn readOffsetVarInt(r: *std.Io.Reader) !u64 {
11891216 const Byte = packed struct { value: u7, has_next: bool };
1190 var b: Byte = @bitCast(try r.readByte());
1217 var b: Byte = @bitCast(try r.takeByte());
11911218 var value: u64 = b.value;
11921219 while (b.has_next) {
1193 b = @bitCast(try r.readByte());
1220 b = @bitCast(try r.takeByte());
11941221 value = std.math.shlExact(u64, value + 1, 7) catch return error.InvalidFormat;
11951222 value |= b.value;
11961223 }
......@@ -1204,19 +1231,12 @@ const IndexHeader = struct {
12041231 const supported_version = 2;
12051232 const size = 4 + 4 + @sizeOf([256]u32);
12061233
1207 fn read(reader: anytype) !IndexHeader {
1208 var header_bytes = try reader.readBytesNoEof(size);
1209 if (!mem.eql(u8, header_bytes[0..4], signature)) return error.InvalidHeader;
1210 const version = mem.readInt(u32, header_bytes[4..8], .big);
1234 fn read(index_header: *IndexHeader, reader: *std.Io.Reader) !void {
1235 const sig = try reader.take(4);
1236 if (!mem.eql(u8, sig, signature)) return error.InvalidHeader;
1237 const version = try reader.takeInt(u32, .big);
12111238 if (version != supported_version) return error.UnsupportedVersion;
1212
1213 var fan_out_table: [256]u32 = undefined;
1214 var fan_out_table_stream = std.io.fixedBufferStream(header_bytes[8..]);
1215 const fan_out_table_reader = fan_out_table_stream.reader();
1216 for (&fan_out_table) |*entry| {
1217 entry.* = fan_out_table_reader.readInt(u32, .big) catch unreachable;
1218 }
1219 return .{ .fan_out_table = fan_out_table };
1239 try reader.readSliceEndian(u32, &index_header.fan_out_table, .big);
12201240 }
12211241};
12221242
......@@ -1227,7 +1247,12 @@ const IndexEntry = struct {
12271247
12281248/// Writes out a version 2 index for the given packfile, as documented in
12291249/// [pack-format](https://git-scm.com/docs/pack-format).
1230pub fn indexPack(allocator: Allocator, format: Oid.Format, pack: *std.fs.File.Reader, index_writer: anytype) !void {
1250pub fn indexPack(
1251 allocator: Allocator,
1252 format: Oid.Format,
1253 pack: *std.fs.File.Reader,
1254 index_writer: *std.fs.File.Writer,
1255) !void {
12311256 try pack.seekTo(0);
12321257
12331258 var index_entries: std.AutoHashMapUnmanaged(Oid, IndexEntry) = .empty;
......@@ -1280,8 +1305,8 @@ pub fn indexPack(allocator: Allocator, format: Oid.Format, pack: *std.fs.File.Re
12801305 }
12811306 @memset(fan_out_table[fan_out_index..], count);
12821307
1283 var index_hashed_writer = hashedWriter(index_writer, Oid.Hasher.init(format));
1284 const writer = index_hashed_writer.writer();
1308 var index_hashed_writer = std.Io.Writer.hashed(&index_writer.interface, Oid.Hasher.init(format), &.{});
1309 const writer = &index_hashed_writer.writer;
12851310 try writer.writeAll(IndexHeader.signature);
12861311 try writer.writeInt(u32, IndexHeader.supported_version, .big);
12871312 for (fan_out_table) |fan_out_entry| {
......@@ -1314,7 +1339,8 @@ pub fn indexPack(allocator: Allocator, format: Oid.Format, pack: *std.fs.File.Re
13141339
13151340 try writer.writeAll(pack_checksum.slice());
13161341 const index_checksum = index_hashed_writer.hasher.finalResult();
1317 try index_writer.writeAll(index_checksum.slice());
1342 try index_writer.interface.writeAll(index_checksum.slice());
1343 try index_writer.end();
13181344}
13191345
13201346/// Performs the first pass over the packfile data for index construction.
......@@ -1328,65 +1354,51 @@ fn indexPackFirstPass(
13281354 index_entries: *std.AutoHashMapUnmanaged(Oid, IndexEntry),
13291355 pending_deltas: *std.ArrayListUnmanaged(IndexEntry),
13301356) !Oid {
1331 var pack_counting_reader = std.io.countingReader(pack.interface.adaptToOldInterface());
1332 var pack_hashed_reader = hashedReader(pack_counting_reader.reader(), Oid.Hasher.init(format));
1333 const pack_reader = pack_hashed_reader.reader();
1334
1335 const pack_header = try PackHeader.read(pack_reader);
1336
1337 var current_entry: u32 = 0;
1338 while (current_entry < pack_header.total_objects) : (current_entry += 1) {
1339 const entry_offset = pack_counting_reader.bytes_read;
1340 var entry_crc32_reader = hashedReader(pack_reader, std.hash.Crc32.init());
1341 const entry_header = try EntryHeader.read(format, entry_crc32_reader.reader());
1342 var adapter_buffer: [1024]u8 = undefined;
1343 var adapter = entry_crc32_reader.reader().adaptToNewApi(&adapter_buffer);
1344 var flate_buffer: [std.compress.flate.max_window_len]u8 = undefined;
1345 var entry_decompress_stream: std.compress.flate.Decompress = .init(&adapter.new_interface, .zlib, &flate_buffer);
1346 const old = entry_decompress_stream.reader.adaptToOldInterface();
1347 var entry_counting_reader = std.io.countingReader(old);
1357 var flate_buffer: [std.compress.flate.max_window_len]u8 = undefined;
1358 var entry_buffer: [1024]u8 = undefined; // Input buffer to flate.
1359 var pack_buffer: [2048]u8 = undefined; // Reasonably large buffer for file system.
1360 var hasher_buffer: [64]u8 = undefined;
1361 var pack_hashed = pack.interface.hashed(Oid.Hasher.init(format), &pack_buffer);
1362
1363 const pack_header = try PackHeader.read(&pack_hashed.reader);
1364
1365 for (0..pack_header.total_objects) |_| {
1366 const entry_offset = pack.logicalPos();
1367 var entry_crc32_stream = pack_hashed.reader.hashed(std.hash.Crc32.init(), &entry_buffer);
1368 const entry_header = try EntryHeader.read(format, &entry_crc32_stream.reader);
1369 var entry_decompress: std.compress.flate.Decompress = .init(&entry_crc32_stream.reader, .zlib, &flate_buffer);
13481370 switch (entry_header) {
13491371 .commit, .tree, .blob, .tag => |object| {
1350 var entry_hashed_writer = hashedWriter(std.io.null_writer, Oid.Hasher.init(format));
1351 const entry_writer = entry_hashed_writer.writer();
1372 var oid_hasher: Oid.Hashing = .init(format, &hasher_buffer);
1373 const oid_hasher_w = oid_hasher.writer();
13521374 // The object header is not included in the pack data but is
13531375 // part of the object's ID
1354 try entry_writer.print("{s} {d}\x00", .{ @tagName(entry_header), object.uncompressed_length });
1355 var fifo = std.fifo.LinearFifo(u8, .{ .Static = 4096 }).init();
1356 try fifo.pump(entry_counting_reader.reader(), entry_writer);
1357 if (entry_counting_reader.bytes_read != object.uncompressed_length) {
1358 return error.InvalidObject;
1359 }
1360 const oid = entry_hashed_writer.hasher.finalResult();
1376 try oid_hasher_w.print("{t} {d}\x00", .{ entry_header, object.uncompressed_length });
1377 const n = try entry_decompress.reader.streamRemaining(oid_hasher_w);
1378 if (n != object.uncompressed_length) return error.InvalidObject;
1379 const oid = oid_hasher.final();
13611380 try index_entries.put(allocator, oid, .{
13621381 .offset = entry_offset,
1363 .crc32 = entry_crc32_reader.hasher.final(),
1382 .crc32 = entry_crc32_stream.hasher.final(),
13641383 });
13651384 },
13661385 inline .ofs_delta, .ref_delta => |delta| {
1367 var fifo = std.fifo.LinearFifo(u8, .{ .Static = 4096 }).init();
1368 try fifo.pump(entry_counting_reader.reader(), std.io.null_writer);
1369 if (entry_counting_reader.bytes_read != delta.uncompressed_length) {
1370 return error.InvalidObject;
1371 }
1386 const n = try entry_decompress.reader.discardRemaining();
1387 if (n != delta.uncompressed_length) return error.InvalidObject;
13721388 try pending_deltas.append(allocator, .{
13731389 .offset = entry_offset,
1374 .crc32 = entry_crc32_reader.hasher.final(),
1390 .crc32 = entry_crc32_stream.hasher.final(),
13751391 });
13761392 },
13771393 }
13781394 }
13791395
1380 const pack_checksum = pack_hashed_reader.hasher.finalResult();
1381 const recorded_checksum = try Oid.readBytes(format, pack.interface.adaptToOldInterface());
1396 const pack_checksum = pack_hashed.hasher.finalResult();
1397 const recorded_checksum = try Oid.readBytes(format, &pack.interface);
13821398 if (!mem.eql(u8, pack_checksum.slice(), recorded_checksum.slice())) {
13831399 return error.CorruptedPack;
13841400 }
1385 _ = pack_reader.readByte() catch |e| switch (e) {
1386 error.EndOfStream => return pack_checksum,
1387 else => |other| return other,
1388 };
1389 return error.InvalidFormat;
1401 return pack_checksum;
13901402}
13911403
13921404/// Attempts to determine the final object ID of the given deltified object.
......@@ -1409,7 +1421,7 @@ fn indexPackHashDelta(
14091421 if (cache.get(base_offset)) |base_object| break base_object;
14101422
14111423 try pack.seekTo(base_offset);
1412 base_header = try EntryHeader.read(format, pack.interface.adaptToOldInterface());
1424 base_header = try EntryHeader.read(format, &pack.interface);
14131425 switch (base_header) {
14141426 .ofs_delta => |ofs_delta| {
14151427 try delta_offsets.append(allocator, base_offset);
......@@ -1431,11 +1443,13 @@ fn indexPackHashDelta(
14311443
14321444 const base_data = try resolveDeltaChain(allocator, format, pack, base_object, delta_offsets.items, cache);
14331445
1434 var entry_hasher: Oid.Hasher = .init(format);
1435 var entry_hashed_writer = hashedWriter(std.io.null_writer, &entry_hasher);
1436 try entry_hashed_writer.writer().print("{s} {}\x00", .{ @tagName(base_object.type), base_data.len });
1437 entry_hasher.update(base_data);
1438 return entry_hasher.finalResult();
1446 var entry_hasher_buffer: [64]u8 = undefined;
1447 var entry_hasher: Oid.Hashing = .init(format, &entry_hasher_buffer);
1448 const entry_hasher_w = entry_hasher.writer();
1449 // Writes to hashers cannot fail.
1450 entry_hasher_w.print("{t} {d}\x00", .{ base_object.type, base_data.len }) catch unreachable;
1451 entry_hasher_w.writeAll(base_data) catch unreachable;
1452 return entry_hasher.final();
14391453}
14401454
14411455/// Resolves a chain of deltas, returning the final base object data. `pack` is
......@@ -1457,21 +1471,19 @@ fn resolveDeltaChain(
14571471
14581472 const delta_offset = delta_offsets[i];
14591473 try pack.seekTo(delta_offset);
1460 const delta_header = try EntryHeader.read(format, pack.interface.adaptToOldInterface());
1474 const delta_header = try EntryHeader.read(format, &pack.interface);
14611475 const delta_data = try readObjectRaw(allocator, &pack.interface, delta_header.uncompressedLength());
14621476 defer allocator.free(delta_data);
1463 var delta_stream = std.io.fixedBufferStream(delta_data);
1464 const delta_reader = delta_stream.reader();
1465 _ = try readSizeVarInt(delta_reader); // base object size
1466 const expanded_size = try readSizeVarInt(delta_reader);
1477 var delta_reader: std.Io.Reader = .fixed(delta_data);
1478 _ = try delta_reader.takeLeb128(u64); // base object size
1479 const expanded_size = try delta_reader.takeLeb128(u64);
14671480
14681481 const expanded_alloc_size = std.math.cast(usize, expanded_size) orelse return error.ObjectTooLarge;
14691482 const expanded_data = try allocator.alloc(u8, expanded_alloc_size);
14701483 errdefer allocator.free(expanded_data);
1471 var expanded_delta_stream = std.io.fixedBufferStream(expanded_data);
1472 var base_stream = std.io.fixedBufferStream(base_data);
1473 try expandDelta(&base_stream, delta_reader, expanded_delta_stream.writer());
1474 if (expanded_delta_stream.pos != expanded_size) return error.InvalidObject;
1484 var expanded_delta_stream: std.Io.Writer = .fixed(expanded_data);
1485 try expandDelta(base_data, &delta_reader, &expanded_delta_stream);
1486 if (expanded_delta_stream.end != expanded_size) return error.InvalidObject;
14751487
14761488 try cache.put(allocator, delta_offset, .{ .type = base_object.type, .data = expanded_data });
14771489 base_data = expanded_data;
......@@ -1497,9 +1509,10 @@ fn readObjectRaw(allocator: Allocator, reader: *std.Io.Reader, size: u64) ![]u8
14971509///
14981510/// The format of the delta data is documented in
14991511/// [pack-format](https://git-scm.com/docs/pack-format).
1500fn expandDelta(base_object: anytype, delta_reader: anytype, writer: anytype) !void {
1512fn expandDelta(base_object: []const u8, delta_reader: *std.Io.Reader, writer: *std.Io.Writer) !void {
1513 var base_offset: u32 = 0;
15011514 while (true) {
1502 const inst: packed struct { value: u7, copy: bool } = @bitCast(delta_reader.readByte() catch |e| switch (e) {
1515 const inst: packed struct { value: u7, copy: bool } = @bitCast(delta_reader.takeByte() catch |e| switch (e) {
15031516 error.EndOfStream => return,
15041517 else => |other| return other,
15051518 });
......@@ -1514,27 +1527,23 @@ fn expandDelta(base_object: anytype, delta_reader: anytype, writer: anytype) !vo
15141527 size3: bool,
15151528 } = @bitCast(inst.value);
15161529 const offset_parts: packed struct { offset1: u8, offset2: u8, offset3: u8, offset4: u8 } = .{
1517 .offset1 = if (available.offset1) try delta_reader.readByte() else 0,
1518 .offset2 = if (available.offset2) try delta_reader.readByte() else 0,
1519 .offset3 = if (available.offset3) try delta_reader.readByte() else 0,
1520 .offset4 = if (available.offset4) try delta_reader.readByte() else 0,
1530 .offset1 = if (available.offset1) try delta_reader.takeByte() else 0,
1531 .offset2 = if (available.offset2) try delta_reader.takeByte() else 0,
1532 .offset3 = if (available.offset3) try delta_reader.takeByte() else 0,
1533 .offset4 = if (available.offset4) try delta_reader.takeByte() else 0,
15211534 };
1522 const offset: u32 = @bitCast(offset_parts);
1535 base_offset = @bitCast(offset_parts);
15231536 const size_parts: packed struct { size1: u8, size2: u8, size3: u8 } = .{
1524 .size1 = if (available.size1) try delta_reader.readByte() else 0,
1525 .size2 = if (available.size2) try delta_reader.readByte() else 0,
1526 .size3 = if (available.size3) try delta_reader.readByte() else 0,
1537 .size1 = if (available.size1) try delta_reader.takeByte() else 0,
1538 .size2 = if (available.size2) try delta_reader.takeByte() else 0,
1539 .size3 = if (available.size3) try delta_reader.takeByte() else 0,
15271540 };
15281541 var size: u24 = @bitCast(size_parts);
15291542 if (size == 0) size = 0x10000;
1530 try base_object.seekTo(offset);
1531 var copy_reader = std.io.limitedReader(base_object.reader(), size);
1532 var fifo = std.fifo.LinearFifo(u8, .{ .Static = 4096 }).init();
1533 try fifo.pump(copy_reader.reader(), writer);
1543 try writer.writeAll(base_object[base_offset..][0..size]);
1544 base_offset += size;
15341545 } else if (inst.value != 0) {
1535 var data_reader = std.io.limitedReader(delta_reader, inst.value);
1536 var fifo = std.fifo.LinearFifo(u8, .{ .Static = 4096 }).init();
1537 try fifo.pump(data_reader.reader(), writer);
1546 try delta_reader.streamExact(writer, inst.value);
15381547 } else {
15391548 return error.InvalidDeltaInstruction;
15401549 }
......@@ -1564,12 +1573,14 @@ fn runRepositoryTest(comptime format: Oid.Format, head_commit: []const u8) !void
15641573 defer pack_file.close();
15651574 try pack_file.writeAll(testrepo_pack);
15661575
1567 var pack_file_buffer: [4096]u8 = undefined;
1576 var pack_file_buffer: [2000]u8 = undefined;
15681577 var pack_file_reader = pack_file.reader(&pack_file_buffer);
15691578
15701579 var index_file = try git_dir.dir.createFile("testrepo.idx", .{ .read = true });
15711580 defer index_file.close();
1572 try indexPack(testing.allocator, format, &pack_file_reader, index_file.deprecatedWriter());
1581 var index_file_buffer: [2000]u8 = undefined;
1582 var index_file_writer = index_file.writer(&index_file_buffer);
1583 try indexPack(testing.allocator, format, &pack_file_reader, &index_file_writer);
15731584
15741585 // Arbitrary size limit on files read while checking the repository contents
15751586 // (all files in the test repo are known to be smaller than this)
......@@ -1583,7 +1594,9 @@ fn runRepositoryTest(comptime format: Oid.Format, head_commit: []const u8) !void
15831594 const testrepo_idx = @embedFile("git/testdata/testrepo-" ++ @tagName(format) ++ ".idx");
15841595 try testing.expectEqualSlices(u8, testrepo_idx, index_file_data);
15851596
1586 var repository = try Repository.init(testing.allocator, format, &pack_file_reader, index_file);
1597 var index_file_reader = index_file.reader(&index_file_buffer);
1598 var repository: Repository = undefined;
1599 try repository.init(testing.allocator, format, &pack_file_reader, &index_file_reader);
15871600 defer repository.deinit();
15881601
15891602 var worktree = testing.tmpDir(.{ .iterate = true });
......@@ -1704,58 +1717,3 @@ pub fn main() !void {
17041717 std.debug.print("Diagnostic: {}\n", .{err});
17051718 }
17061719}
1707
1708/// Deprecated
1709fn hashedReader(reader: anytype, hasher: anytype) HashedReader(@TypeOf(reader), @TypeOf(hasher)) {
1710 return .{ .child_reader = reader, .hasher = hasher };
1711}
1712
1713/// Deprecated
1714fn HashedReader(ReaderType: type, HasherType: type) type {
1715 return struct {
1716 child_reader: ReaderType,
1717 hasher: HasherType,
1718
1719 pub const Error = ReaderType.Error;
1720 pub const Reader = std.io.GenericReader(*@This(), Error, read);
1721
1722 pub fn read(self: *@This(), buf: []u8) Error!usize {
1723 const amt = try self.child_reader.read(buf);
1724 self.hasher.update(buf[0..amt]);
1725 return amt;
1726 }
1727
1728 pub fn reader(self: *@This()) Reader {
1729 return .{ .context = self };
1730 }
1731 };
1732}
1733
1734/// Deprecated
1735pub fn HashedWriter(WriterType: type, HasherType: type) type {
1736 return struct {
1737 child_writer: WriterType,
1738 hasher: HasherType,
1739
1740 pub const Error = WriterType.Error;
1741 pub const Writer = std.io.GenericWriter(*@This(), Error, write);
1742
1743 pub fn write(self: *@This(), buf: []const u8) Error!usize {
1744 const amt = try self.child_writer.write(buf);
1745 self.hasher.update(buf[0..amt]);
1746 return amt;
1747 }
1748
1749 pub fn writer(self: *@This()) Writer {
1750 return .{ .context = self };
1751 }
1752 };
1753}
1754
1755/// Deprecated
1756pub fn hashedWriter(
1757 writer: anytype,
1758 hasher: anytype,
1759) HashedWriter(@TypeOf(writer), @TypeOf(hasher)) {
1760 return .{ .child_writer = writer, .hasher = hasher };
1761}