2026-05-02 23:04:46 +03:00
|
|
|
|
#!/usr/bin/env python3
|
|
|
|
|
|
# -*- coding: utf-8 -*-
|
|
|
|
|
|
|
|
|
|
|
|
"""
|
2026-05-23 08:52:52 +03:00
|
|
|
|
Первый проход КВС (однопроходная версия с заглушками)
|
|
|
|
|
|
Генерирует CSV-таблицу напрямую из AST
|
|
|
|
|
|
- Неизвестные метки заменяются заглушками (0xCC) с пометкой в колонке 'уводящий_адрес'
|
|
|
|
|
|
- В колонке 'приводящая_метка' записываются имена меток, находящихся по данному адресу (через запятую)
|
2026-05-23 18:56:43 +03:00
|
|
|
|
- Колонка 'команда_со_значениями' оставлена пустой (для второго прохода)
|
2026-05-23 08:52:52 +03:00
|
|
|
|
- Колонки 'рассчитанный_уводящий_адрес' и 'рассчитанный_байт' оставлены для второго прохода
|
2026-05-23 18:56:43 +03:00
|
|
|
|
- Колонка 'виртуальный_адрес' содержит виртуальный адрес байта (для pass4)
|
2026-05-02 23:04:46 +03:00
|
|
|
|
"""
|
|
|
|
|
|
|
|
|
|
|
|
import sys
|
2026-05-23 08:52:52 +03:00
|
|
|
|
import csv
|
2026-05-23 20:35:41 +03:00
|
|
|
|
import struct # <--- НОВЫЙ ИМПОРТ
|
2026-05-23 08:52:52 +03:00
|
|
|
|
|
2026-05-02 23:04:46 +03:00
|
|
|
|
sys.path.insert(0, '.')
|
2026-05-23 20:35:41 +03:00
|
|
|
|
from kvs_data import (
|
|
|
|
|
|
PAGE_SIZE, text_vaddr_base, align_up,
|
|
|
|
|
|
ALWAYS_STUB_INSTRUCTIONS
|
|
|
|
|
|
)
|
2026-05-23 08:52:52 +03:00
|
|
|
|
from kvs_encoder import encode_instruction
|
|
|
|
|
|
|
|
|
|
|
|
# ========== ГЛОБАЛЬНОЕ СОСТОЯНИЕ ==========
|
2026-05-23 20:35:41 +03:00
|
|
|
|
entries = []
|
2026-05-23 08:52:52 +03:00
|
|
|
|
current_address = 0
|
|
|
|
|
|
current_segment = '.header'
|
|
|
|
|
|
last_segment = None
|
|
|
|
|
|
|
|
|
|
|
|
vaddr_text = text_vaddr_base
|
|
|
|
|
|
vaddr_data = None
|
|
|
|
|
|
vaddr_bnd = None
|
|
|
|
|
|
|
|
|
|
|
|
text_buffer = bytearray()
|
|
|
|
|
|
data_buffer = bytearray()
|
|
|
|
|
|
bnd_size = 0
|
|
|
|
|
|
|
2026-05-23 18:56:43 +03:00
|
|
|
|
labels = {}
|
|
|
|
|
|
label_sections = {}
|
|
|
|
|
|
symbols = {}
|
2026-05-23 08:52:52 +03:00
|
|
|
|
|
2026-05-23 18:56:43 +03:00
|
|
|
|
pending_labels = []
|
2026-05-23 08:52:52 +03:00
|
|
|
|
|
|
|
|
|
|
text_pos = 0
|
|
|
|
|
|
data_pos = 0
|
|
|
|
|
|
|
|
|
|
|
|
entry_point = "_start"
|
|
|
|
|
|
relocations = []
|
|
|
|
|
|
|
2026-05-23 18:56:43 +03:00
|
|
|
|
|
2026-05-23 08:52:52 +03:00
|
|
|
|
def reset_state():
|
|
|
|
|
|
global entries, current_address, current_segment, last_segment
|
|
|
|
|
|
global text_buffer, data_buffer, bnd_size, vaddr_data, vaddr_bnd
|
|
|
|
|
|
global labels, label_sections, symbols, text_pos, data_pos, entry_point, relocations
|
|
|
|
|
|
global pending_labels
|
|
|
|
|
|
|
|
|
|
|
|
entries = []
|
|
|
|
|
|
current_address = 0
|
|
|
|
|
|
current_segment = '.header'
|
|
|
|
|
|
last_segment = None
|
|
|
|
|
|
text_buffer = bytearray()
|
|
|
|
|
|
data_buffer = bytearray()
|
|
|
|
|
|
bnd_size = 0
|
|
|
|
|
|
vaddr_data = None
|
|
|
|
|
|
vaddr_bnd = None
|
|
|
|
|
|
labels = {}
|
|
|
|
|
|
label_sections = {}
|
|
|
|
|
|
symbols = {}
|
|
|
|
|
|
text_pos = 0
|
|
|
|
|
|
data_pos = 0
|
|
|
|
|
|
entry_point = "_start"
|
|
|
|
|
|
relocations = []
|
|
|
|
|
|
pending_labels = []
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
def set_segment(segment: str):
|
|
|
|
|
|
global current_segment
|
|
|
|
|
|
current_segment = segment
|
|
|
|
|
|
|
|
|
|
|
|
|
2026-05-23 18:56:43 +03:00
|
|
|
|
def get_virtual_address():
|
|
|
|
|
|
"""Возвращает виртуальный адрес для текущей позиции"""
|
|
|
|
|
|
if current_segment == '.text':
|
|
|
|
|
|
return vaddr_text + (current_address - 0x1000)
|
|
|
|
|
|
elif current_segment == '.data':
|
|
|
|
|
|
if vaddr_data is None:
|
|
|
|
|
|
return current_address
|
|
|
|
|
|
return vaddr_data + (current_address - 0x2000)
|
|
|
|
|
|
else:
|
|
|
|
|
|
return current_address
|
|
|
|
|
|
|
|
|
|
|
|
|
2026-05-23 08:52:52 +03:00
|
|
|
|
def add_byte(value: int, source: str = "", target=None, labels_list=None):
|
|
|
|
|
|
global current_address, last_segment, pending_labels
|
|
|
|
|
|
|
|
|
|
|
|
effective_labels = ""
|
|
|
|
|
|
if labels_list is not None and labels_list:
|
|
|
|
|
|
effective_labels = ','.join(labels_list)
|
|
|
|
|
|
elif pending_labels:
|
|
|
|
|
|
effective_labels = ','.join(pending_labels)
|
|
|
|
|
|
|
|
|
|
|
|
show_segment = current_segment if current_segment != last_segment else None
|
|
|
|
|
|
if show_segment:
|
|
|
|
|
|
last_segment = current_segment
|
|
|
|
|
|
|
2026-05-23 18:56:43 +03:00
|
|
|
|
virt_addr = get_virtual_address()
|
|
|
|
|
|
byte_val = value & 0xFF
|
|
|
|
|
|
|
2026-05-23 08:52:52 +03:00
|
|
|
|
entries.append((
|
2026-05-23 18:56:43 +03:00
|
|
|
|
show_segment if show_segment else "",
|
|
|
|
|
|
current_address,
|
2026-05-23 20:35:41 +03:00
|
|
|
|
f"0x{virt_addr:08x}",
|
|
|
|
|
|
f"0x{byte_val:02x}",
|
2026-05-23 18:56:43 +03:00
|
|
|
|
target if target else "",
|
|
|
|
|
|
source,
|
|
|
|
|
|
effective_labels,
|
2026-05-23 20:35:41 +03:00
|
|
|
|
"",
|
|
|
|
|
|
"",
|
|
|
|
|
|
f"0x{byte_val:02x}"
|
2026-05-23 08:52:52 +03:00
|
|
|
|
))
|
|
|
|
|
|
current_address += 1
|
|
|
|
|
|
|
|
|
|
|
|
if pending_labels:
|
|
|
|
|
|
pending_labels = []
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
def add_bytes(values, source: str = "", target=None):
|
|
|
|
|
|
for i, v in enumerate(values):
|
|
|
|
|
|
add_byte(v, source if i == 0 else "", target if i == 0 else None)
|
|
|
|
|
|
|
|
|
|
|
|
|
2026-05-23 20:35:41 +03:00
|
|
|
|
# ========== РЕФАКТОРИНГ: ИСПОЛЬЗУЕМ struct.pack ==========
|
|
|
|
|
|
|
2026-05-23 08:52:52 +03:00
|
|
|
|
def add_word16(value: int, source: str = "", target=None):
|
2026-05-23 20:35:41 +03:00
|
|
|
|
"""Добавляет 16-битное значение (little-endian)"""
|
|
|
|
|
|
add_bytes(struct.pack('<H', value & 0xFFFF), source, target)
|
2026-05-23 08:52:52 +03:00
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
def add_word32(value: int, source: str = "", target=None):
|
2026-05-23 20:35:41 +03:00
|
|
|
|
"""Добавляет 32-битное значение (little-endian)"""
|
|
|
|
|
|
add_bytes(struct.pack('<I', value & 0xFFFFFFFF), source, target)
|
2026-05-23 08:52:52 +03:00
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
def add_word64(value: int, source: str = "", target=None):
|
2026-05-23 20:35:41 +03:00
|
|
|
|
"""Добавляет 64-битное значение (little-endian)"""
|
|
|
|
|
|
add_bytes(struct.pack('<Q', value & 0xFFFFFFFFFFFFFFFF), source, target)
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
def add_dwords(values: list, source: str = "", target=None):
|
|
|
|
|
|
"""Добавляет несколько 32-битных значений"""
|
|
|
|
|
|
for val in values:
|
|
|
|
|
|
add_word32(val, source, target)
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
def add_qwords(values: list, source: str = "", target=None):
|
|
|
|
|
|
"""Добавляет несколько 64-битных значений"""
|
|
|
|
|
|
for val in values:
|
|
|
|
|
|
add_word64(val, source, target)
|
2026-05-23 08:52:52 +03:00
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
def align_to(alignment: int):
|
|
|
|
|
|
global current_address, pending_labels
|
|
|
|
|
|
padding = (alignment - (current_address % alignment)) % alignment
|
|
|
|
|
|
if padding > 0:
|
|
|
|
|
|
pending_labels = []
|
|
|
|
|
|
current_address += padding
|
2026-05-17 22:37:32 +03:00
|
|
|
|
|
2026-05-02 23:04:46 +03:00
|
|
|
|
|
|
|
|
|
|
def unescape_string(s):
|
|
|
|
|
|
result = []
|
|
|
|
|
|
i = 0
|
|
|
|
|
|
while i < len(s):
|
|
|
|
|
|
if s[i] == '\\' and i + 1 < len(s):
|
|
|
|
|
|
if s[i + 1] == 'n':
|
|
|
|
|
|
result.append('\n')
|
|
|
|
|
|
elif s[i + 1] == 't':
|
|
|
|
|
|
result.append('\t')
|
|
|
|
|
|
elif s[i + 1] == 'r':
|
|
|
|
|
|
result.append('\r')
|
|
|
|
|
|
else:
|
|
|
|
|
|
result.append(s[i + 1])
|
|
|
|
|
|
i += 2
|
|
|
|
|
|
else:
|
|
|
|
|
|
result.append(s[i])
|
|
|
|
|
|
i += 1
|
|
|
|
|
|
return ''.join(result)
|
|
|
|
|
|
|
2026-05-23 08:52:52 +03:00
|
|
|
|
|
|
|
|
|
|
def generate_elf_header():
|
2026-05-23 20:35:41 +03:00
|
|
|
|
"""Генерирует заголовок ELF (64 байта)"""
|
|
|
|
|
|
# ELF magic
|
2026-05-23 08:52:52 +03:00
|
|
|
|
add_bytes([0x7F, 0x45, 0x4C, 0x46], "ELF magic")
|
|
|
|
|
|
add_byte(2, "ELFCLASS64")
|
|
|
|
|
|
add_byte(1, "ELFDATA2LSB")
|
|
|
|
|
|
add_byte(1, "ELF version")
|
|
|
|
|
|
add_byte(0, "OS ABI")
|
|
|
|
|
|
add_byte(0, "ABI version")
|
|
|
|
|
|
add_bytes([0] * 7, "Padding")
|
2026-05-23 20:35:41 +03:00
|
|
|
|
|
|
|
|
|
|
# e_type, e_machine, e_version
|
2026-05-23 08:52:52 +03:00
|
|
|
|
add_word16(2, "e_type = ET_EXEC")
|
|
|
|
|
|
add_word16(62, "e_machine = EM_X86_64")
|
|
|
|
|
|
add_word32(1, "e_version")
|
2026-05-23 20:35:41 +03:00
|
|
|
|
|
|
|
|
|
|
# e_entry (stub - будет заполнен позже)
|
2026-05-23 08:52:52 +03:00
|
|
|
|
add_word64(0, "e_entry (stub)")
|
2026-05-23 20:35:41 +03:00
|
|
|
|
|
|
|
|
|
|
# e_phoff, e_shoff
|
2026-05-23 08:52:52 +03:00
|
|
|
|
add_word64(64, "e_phoff")
|
|
|
|
|
|
add_word64(0, "e_shoff = 0")
|
2026-05-23 20:35:41 +03:00
|
|
|
|
|
|
|
|
|
|
# e_flags, e_ehsize, e_phentsize
|
2026-05-23 08:52:52 +03:00
|
|
|
|
add_word32(0, "e_flags")
|
|
|
|
|
|
add_word16(64, "e_ehsize")
|
|
|
|
|
|
add_word16(56, "e_phentsize")
|
2026-05-23 20:35:41 +03:00
|
|
|
|
|
|
|
|
|
|
# e_phnum, e_shentsize, e_shnum, e_shstrndx
|
2026-05-23 08:52:52 +03:00
|
|
|
|
add_word16(2, "e_phnum = 2")
|
|
|
|
|
|
add_word16(0, "e_shentsize = 0")
|
|
|
|
|
|
add_word16(0, "e_shnum = 0")
|
|
|
|
|
|
add_word16(0, "e_shstrndx")
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
def generate_program_headers():
|
2026-05-23 20:35:41 +03:00
|
|
|
|
"""Генерирует два программных заголовка (PT_LOAD)"""
|
|
|
|
|
|
# === Первый заголовок: TEXT (RX) ===
|
2026-05-23 08:52:52 +03:00
|
|
|
|
add_word32(1, "p_type = PT_LOAD")
|
|
|
|
|
|
add_word32(5, "p_flags = RX")
|
2026-05-23 20:35:41 +03:00
|
|
|
|
add_word64(0, "p_offset (text stub)") # будет заполнено позже
|
2026-05-23 08:52:52 +03:00
|
|
|
|
add_word64(vaddr_text, "p_vaddr (text)")
|
|
|
|
|
|
add_word64(vaddr_text, "p_paddr (text)")
|
2026-05-23 20:35:41 +03:00
|
|
|
|
add_word64(0, "p_filesz (text stub)") # будет заполнено позже
|
|
|
|
|
|
add_word64(0, "p_memsz (text stub)") # будет заполнено позже
|
2026-05-23 08:52:52 +03:00
|
|
|
|
add_word64(PAGE_SIZE, "p_align")
|
|
|
|
|
|
|
2026-05-23 20:35:41 +03:00
|
|
|
|
# === Второй заголовок: DATA (RW) ===
|
2026-05-23 08:52:52 +03:00
|
|
|
|
add_word32(1, "p_type = PT_LOAD")
|
|
|
|
|
|
add_word32(6, "p_flags = RW")
|
2026-05-23 20:35:41 +03:00
|
|
|
|
add_word64(0, "p_offset (data stub)") # будет заполнено позже
|
|
|
|
|
|
add_word64(0, "p_vaddr (data stub)") # будет заполнено позже
|
|
|
|
|
|
add_word64(0, "p_paddr (data stub)") # будет заполнено позже
|
|
|
|
|
|
add_word64(0, "p_filesz (data stub)") # будет заполнено позже
|
|
|
|
|
|
add_word64(0, "p_memsz (data stub)") # будет заполнено позже
|
2026-05-23 08:52:52 +03:00
|
|
|
|
add_word64(PAGE_SIZE, "p_align")
|
|
|
|
|
|
|
|
|
|
|
|
|
2026-05-02 23:04:46 +03:00
|
|
|
|
def read_ast(input_file):
|
|
|
|
|
|
with open(input_file, 'r', encoding='utf-8') as f:
|
2026-05-23 08:52:52 +03:00
|
|
|
|
return [line.strip() for line in f]
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
def parse_ast_line(line):
|
|
|
|
|
|
if not line:
|
|
|
|
|
|
return None, {}
|
2026-05-11 15:08:03 +03:00
|
|
|
|
|
2026-05-23 08:52:52 +03:00
|
|
|
|
line_type = line.split(':')[0]
|
2026-05-11 15:08:03 +03:00
|
|
|
|
|
2026-05-23 08:52:52 +03:00
|
|
|
|
if line_type == "INSTR":
|
|
|
|
|
|
first = line.find(':')
|
|
|
|
|
|
second = line.find(':', first + 1)
|
|
|
|
|
|
third = line.find(':', second + 1)
|
|
|
|
|
|
|
|
|
|
|
|
if first == -1 or second == -1 or third == -1:
|
|
|
|
|
|
return "INSTR", {}
|
|
|
|
|
|
|
|
|
|
|
|
mnemonic = line[first + 1:second]
|
|
|
|
|
|
section = line[second + 1:third]
|
|
|
|
|
|
operands_str = line[third + 1:]
|
|
|
|
|
|
operands = operands_str.split(',') if operands_str else []
|
|
|
|
|
|
|
|
|
|
|
|
return "INSTR", {
|
|
|
|
|
|
'mnemonic': mnemonic,
|
|
|
|
|
|
'section': section,
|
|
|
|
|
|
'operands': operands
|
|
|
|
|
|
}
|
2026-05-11 15:08:03 +03:00
|
|
|
|
|
2026-05-23 08:52:52 +03:00
|
|
|
|
elif line_type == "DIRECTIVE":
|
|
|
|
|
|
parts = line.split(':')
|
|
|
|
|
|
directive = parts[1] if len(parts) > 1 else ""
|
|
|
|
|
|
|
|
|
|
|
|
if directive in ('.текст', '.данные', '.бнд'):
|
|
|
|
|
|
return "DIRECTIVE", {'directive': directive}
|
|
|
|
|
|
elif directive == '.глобал':
|
|
|
|
|
|
return "DIRECTIVE", {'directive': directive, 'label': parts[2] if len(parts) > 2 else ""}
|
|
|
|
|
|
elif directive in ('.строка', '.строка_нуль'):
|
|
|
|
|
|
return "DIRECTIVE", {
|
|
|
|
|
|
'directive': directive,
|
|
|
|
|
|
'section': parts[2] if len(parts) > 2 else "",
|
|
|
|
|
|
'string': parts[3] if len(parts) > 3 else ""
|
|
|
|
|
|
}
|
|
|
|
|
|
elif directive == '.константа':
|
|
|
|
|
|
return "DIRECTIVE", {
|
|
|
|
|
|
'directive': directive,
|
|
|
|
|
|
'name': parts[2] if len(parts) > 2 else "",
|
|
|
|
|
|
'value': parts[3] if len(parts) > 3 else ""
|
|
|
|
|
|
}
|
|
|
|
|
|
elif directive == '.байт':
|
|
|
|
|
|
return "DIRECTIVE", {
|
|
|
|
|
|
'directive': directive,
|
|
|
|
|
|
'section': parts[2] if len(parts) > 2 else "",
|
|
|
|
|
|
'bytes': parts[3] if len(parts) > 3 else ""
|
|
|
|
|
|
}
|
|
|
|
|
|
elif directive in ('.резб', '.резс', '.рездс', '.резкс'):
|
|
|
|
|
|
return "DIRECTIVE", {
|
|
|
|
|
|
'directive': directive,
|
|
|
|
|
|
'section': parts[2] if len(parts) > 2 else "",
|
|
|
|
|
|
'count': parts[3] if len(parts) > 3 else "0"
|
|
|
|
|
|
}
|
2026-05-11 15:08:03 +03:00
|
|
|
|
else:
|
2026-05-23 08:52:52 +03:00
|
|
|
|
return "DIRECTIVE", {'directive': directive}
|
2026-05-11 15:08:03 +03:00
|
|
|
|
|
2026-05-23 08:52:52 +03:00
|
|
|
|
elif line_type == "LABEL":
|
|
|
|
|
|
parts = line.split(':')
|
|
|
|
|
|
return "LABEL", {
|
|
|
|
|
|
'name': parts[1] if len(parts) > 1 else "",
|
|
|
|
|
|
'section': parts[2] if len(parts) > 2 else ""
|
|
|
|
|
|
}
|
2026-05-11 15:08:03 +03:00
|
|
|
|
|
2026-05-23 08:52:52 +03:00
|
|
|
|
return line_type, {}
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
def get_stub_size(mnemonic, operands):
|
2026-05-23 18:56:43 +03:00
|
|
|
|
if mnemonic in ("переход", "вызвать"):
|
|
|
|
|
|
return 5
|
|
|
|
|
|
elif mnemonic == "короткий_переход":
|
|
|
|
|
|
return 2
|
|
|
|
|
|
elif mnemonic.startswith("переход_если") and not mnemonic.startswith("короткий"):
|
|
|
|
|
|
return 6
|
|
|
|
|
|
elif mnemonic.startswith("короткий_переход_если"):
|
|
|
|
|
|
return 2
|
|
|
|
|
|
elif mnemonic == "цикл":
|
|
|
|
|
|
return 2
|
|
|
|
|
|
elif mnemonic == "переместить_имм" and len(operands) >= 2:
|
2026-05-23 08:52:52 +03:00
|
|
|
|
reg = operands[0]
|
|
|
|
|
|
if reg in ('раикс', 'рбикс', 'рсикс', 'рдикс', 'рсипи', 'рбипи', 'рсиай', 'рдиай',
|
|
|
|
|
|
'р8', 'р9', 'р10', 'р11', 'р12', 'р13', 'р14', 'р15'):
|
|
|
|
|
|
return 10
|
|
|
|
|
|
elif reg in ('еаикс', 'ебикс', 'есикс', 'едикс'):
|
|
|
|
|
|
return 7
|
|
|
|
|
|
else:
|
|
|
|
|
|
return 2
|
|
|
|
|
|
elif mnemonic in ("загрузить", "сохранить", "загрузить_адрес"):
|
|
|
|
|
|
return 7
|
2026-05-23 18:56:43 +03:00
|
|
|
|
elif mnemonic == "сравнить_с":
|
|
|
|
|
|
return 7
|
|
|
|
|
|
elif mnemonic in ("прибавить_непосредственно", "вычесть_непосредственно"):
|
|
|
|
|
|
return 7
|
|
|
|
|
|
elif mnemonic in ("переместить_с_нулями", "переместить_со_знаком"):
|
|
|
|
|
|
return 7
|
2026-05-23 08:52:52 +03:00
|
|
|
|
return 1
|
|
|
|
|
|
|
|
|
|
|
|
|
2026-05-23 18:56:43 +03:00
|
|
|
|
def extract_label_from_operands(operands):
|
|
|
|
|
|
"""Извлекает первую метку из операндов инструкции"""
|
|
|
|
|
|
for op in operands:
|
|
|
|
|
|
if not op:
|
|
|
|
|
|
continue
|
|
|
|
|
|
# Пропускаем регистры
|
|
|
|
|
|
if op in ('раикс', 'рбикс', 'рсикс', 'рдикс', 'рсипи', 'рбипи', 'рсиай', 'рдиай',
|
|
|
|
|
|
'еаикс', 'ебикс', 'есикс', 'едикс',
|
|
|
|
|
|
'аикс', 'бикс', 'сикс', 'дикс',
|
|
|
|
|
|
'ал', 'бл', 'кл', 'дл',
|
|
|
|
|
|
'р8', 'р9', 'р10', 'р11', 'р12', 'р13', 'р14', 'р15'):
|
|
|
|
|
|
continue
|
|
|
|
|
|
# Пропускаем числа
|
|
|
|
|
|
if op.isdigit() or (op.startswith('0x') and len(op) > 2):
|
|
|
|
|
|
continue
|
|
|
|
|
|
# Пропускаем косвенную адресацию через регистр
|
|
|
|
|
|
if op.startswith('MEM:reg_indirect:'):
|
|
|
|
|
|
continue
|
|
|
|
|
|
# Извлекаем метку из [метка]
|
|
|
|
|
|
if op.startswith('[') and op.endswith(']'):
|
|
|
|
|
|
inner = op[1:-1]
|
|
|
|
|
|
if inner not in ('раикс', 'рбикс', 'рсикс', 'рдикс', 'рсипи', 'рбипи', 'рсиай', 'рдиай'):
|
|
|
|
|
|
if not inner.isdigit() and not inner.startswith('0x'):
|
|
|
|
|
|
return inner
|
|
|
|
|
|
# Обычная метка
|
|
|
|
|
|
elif op not in symbols:
|
|
|
|
|
|
return op
|
|
|
|
|
|
return None
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
def has_unresolved_labels(operands, mnemonic=""):
|
|
|
|
|
|
if mnemonic in ALWAYS_STUB_INSTRUCTIONS:
|
|
|
|
|
|
for op in operands:
|
|
|
|
|
|
if op and not op.isdigit() and not op.startswith('0x'):
|
|
|
|
|
|
if op not in ('раикс', 'рбикс', 'рсикс', 'рдикс', 'рсипи', 'рбипи', 'рсиай', 'рдиай',
|
|
|
|
|
|
'еаикс', 'ебикс', 'есикс', 'едикс',
|
|
|
|
|
|
'аикс', 'бикс', 'сикс', 'дикс',
|
|
|
|
|
|
'ал', 'бл', 'кл', 'дл'):
|
|
|
|
|
|
return True
|
|
|
|
|
|
|
2026-05-23 08:52:52 +03:00
|
|
|
|
for op in operands:
|
|
|
|
|
|
if not op:
|
|
|
|
|
|
continue
|
|
|
|
|
|
if op in ('раикс', 'рбикс', 'рсикс', 'рдикс', 'рсипи', 'рбипи', 'рсиай', 'рдиай',
|
|
|
|
|
|
'еаикс', 'ебикс', 'есикс', 'едикс',
|
|
|
|
|
|
'аикс', 'бикс', 'сикс', 'дикс',
|
2026-05-23 18:56:43 +03:00
|
|
|
|
'ал', 'бл', 'кл', 'дл',
|
|
|
|
|
|
'р8', 'р9', 'р10', 'р11', 'р12', 'р13', 'р14', 'р15',
|
|
|
|
|
|
'р8д', 'р9д', 'р10д', 'р11д', 'р12д', 'р13д', 'р14д', 'р15д',
|
|
|
|
|
|
'р8в', 'р9в', 'р10в', 'р11в', 'р12в', 'р13в', 'р14в', 'р15в',
|
|
|
|
|
|
'р8б', 'р9б', 'р10б', 'р11б', 'р12б', 'р13б', 'р14б', 'р15б',
|
|
|
|
|
|
'спл', 'бпл', 'сил', 'дил'):
|
|
|
|
|
|
continue
|
|
|
|
|
|
if op.startswith('MEM:reg_indirect:'):
|
2026-05-23 08:52:52 +03:00
|
|
|
|
continue
|
|
|
|
|
|
if op.startswith('[') and op.endswith(']'):
|
|
|
|
|
|
inner = op[1:-1]
|
|
|
|
|
|
if inner in ('раикс', 'рбикс', 'рсикс', 'рдикс', 'рсипи', 'рбипи', 'рсиай', 'рдиай'):
|
|
|
|
|
|
continue
|
2026-05-23 18:56:43 +03:00
|
|
|
|
if inner.isdigit() or (inner.startswith('0x') and len(inner) > 2):
|
2026-05-23 08:52:52 +03:00
|
|
|
|
continue
|
2026-05-23 18:56:43 +03:00
|
|
|
|
if inner not in labels:
|
|
|
|
|
|
return True
|
2026-05-23 08:52:52 +03:00
|
|
|
|
continue
|
2026-05-23 18:56:43 +03:00
|
|
|
|
if op.isdigit() or (op.startswith('0x') and len(op) > 2):
|
2026-05-11 15:08:03 +03:00
|
|
|
|
continue
|
2026-05-23 18:56:43 +03:00
|
|
|
|
if op in symbols:
|
|
|
|
|
|
continue
|
|
|
|
|
|
if op not in labels:
|
2026-05-23 08:52:52 +03:00
|
|
|
|
return True
|
2026-05-23 18:56:43 +03:00
|
|
|
|
|
2026-05-23 08:52:52 +03:00
|
|
|
|
return False
|
2026-05-11 15:08:03 +03:00
|
|
|
|
|
2026-05-23 08:52:52 +03:00
|
|
|
|
|
|
|
|
|
|
def get_unresolved_labels(operands):
|
|
|
|
|
|
unresolved = []
|
|
|
|
|
|
for op in operands:
|
|
|
|
|
|
if not op:
|
|
|
|
|
|
continue
|
|
|
|
|
|
if op.startswith('[') and op.endswith(']'):
|
|
|
|
|
|
inner = op[1:-1]
|
|
|
|
|
|
if inner not in labels and not inner.isdigit() and not (inner.startswith('0x')):
|
|
|
|
|
|
if inner not in ('раикс', 'рбикс', 'рсикс', 'рдикс', 'рсипи', 'рбипи', 'рсиай', 'рдиай'):
|
|
|
|
|
|
if inner not in symbols:
|
|
|
|
|
|
unresolved.append(inner)
|
|
|
|
|
|
elif op not in labels and not op.isdigit() and not (op.startswith('0x')):
|
|
|
|
|
|
if op not in ('раикс', 'рбикс', 'рсикс', 'рдикс', 'рсипи', 'рбипи', 'рсиай', 'рдиай',
|
|
|
|
|
|
'еаикс', 'ебикс', 'есикс', 'едикс',
|
|
|
|
|
|
'аикс', 'бикс', 'сикс', 'дикс',
|
2026-05-23 18:56:43 +03:00
|
|
|
|
'ал', 'бл', 'кл', 'дл',
|
|
|
|
|
|
'р8', 'р9', 'р10', 'р11', 'р12', 'р13', 'р14', 'р15'):
|
2026-05-23 08:52:52 +03:00
|
|
|
|
if op not in symbols:
|
|
|
|
|
|
unresolved.append(op)
|
|
|
|
|
|
return unresolved
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
def process_ast_line(line):
|
|
|
|
|
|
global text_pos, data_pos, vaddr_data, vaddr_bnd, bnd_size
|
|
|
|
|
|
global text_buffer, data_buffer, entry_point, symbols, pending_labels
|
2026-05-11 15:08:03 +03:00
|
|
|
|
|
2026-05-23 08:52:52 +03:00
|
|
|
|
line_type, fields = parse_ast_line(line)
|
2026-05-11 15:08:03 +03:00
|
|
|
|
|
2026-05-23 08:52:52 +03:00
|
|
|
|
if line_type == "DIRECTIVE":
|
|
|
|
|
|
directive = fields.get('directive', '')
|
2026-05-02 23:04:46 +03:00
|
|
|
|
|
2026-05-23 08:52:52 +03:00
|
|
|
|
if directive == '.текст':
|
|
|
|
|
|
set_segment('.text')
|
2026-05-02 23:04:46 +03:00
|
|
|
|
|
2026-05-23 08:52:52 +03:00
|
|
|
|
elif directive == '.данные':
|
|
|
|
|
|
set_segment('.data')
|
|
|
|
|
|
align_to(PAGE_SIZE)
|
|
|
|
|
|
|
|
|
|
|
|
elif directive == '.бнд':
|
|
|
|
|
|
set_segment('.bss')
|
|
|
|
|
|
|
|
|
|
|
|
elif directive == '.глобал':
|
|
|
|
|
|
entry_point = fields.get('label', '_start')
|
|
|
|
|
|
|
|
|
|
|
|
elif directive == '.константа':
|
|
|
|
|
|
name = fields.get('name', '')
|
|
|
|
|
|
value_str = fields.get('value', '')
|
|
|
|
|
|
if value_str.startswith('0x') or value_str.startswith('0X'):
|
|
|
|
|
|
value = int(value_str, 16)
|
|
|
|
|
|
else:
|
|
|
|
|
|
value = int(value_str)
|
|
|
|
|
|
symbols[name] = value
|
|
|
|
|
|
print(f" константа: {name} = {value}")
|
|
|
|
|
|
|
|
|
|
|
|
elif directive in ('.строка', '.строка_нуль'):
|
|
|
|
|
|
s = fields.get('string', '')
|
|
|
|
|
|
real_s = unescape_string(s)
|
|
|
|
|
|
bstring = real_s.encode('utf-8')
|
|
|
|
|
|
if directive == '.строка_нуль':
|
|
|
|
|
|
bstring += b'\x00'
|
2026-05-02 23:04:46 +03:00
|
|
|
|
|
2026-05-23 08:52:52 +03:00
|
|
|
|
source = f'{directive} "{s}"'
|
|
|
|
|
|
|
|
|
|
|
|
for i, byte in enumerate(bstring):
|
|
|
|
|
|
labels_list = pending_labels if i == 0 else None
|
|
|
|
|
|
add_byte(byte, source if i == 0 else "", None, labels_list)
|
|
|
|
|
|
data_buffer.append(byte)
|
|
|
|
|
|
if labels_list:
|
|
|
|
|
|
pending_labels = []
|
|
|
|
|
|
data_pos += len(bstring)
|
2026-05-11 15:08:03 +03:00
|
|
|
|
|
2026-05-23 08:52:52 +03:00
|
|
|
|
elif directive == '.байт':
|
|
|
|
|
|
bytes_str = fields.get('bytes', '')
|
|
|
|
|
|
if bytes_str:
|
|
|
|
|
|
byte_values = bytes_str.split(',')
|
|
|
|
|
|
source = f'.байт {bytes_str}'
|
|
|
|
|
|
bstring = bytearray()
|
|
|
|
|
|
for byte_str in byte_values:
|
|
|
|
|
|
byte_str = byte_str.strip()
|
|
|
|
|
|
if byte_str.startswith('0x'):
|
|
|
|
|
|
val = int(byte_str, 16)
|
|
|
|
|
|
else:
|
|
|
|
|
|
val = int(byte_str)
|
|
|
|
|
|
bstring.append(val & 0xFF)
|
|
|
|
|
|
|
|
|
|
|
|
for i, byte in enumerate(bstring):
|
|
|
|
|
|
labels_list = pending_labels if i == 0 else None
|
|
|
|
|
|
add_byte(byte, source if i == 0 else "", None, labels_list)
|
|
|
|
|
|
data_buffer.append(byte)
|
|
|
|
|
|
if labels_list:
|
|
|
|
|
|
pending_labels = []
|
|
|
|
|
|
data_pos += len(bstring)
|
2026-05-17 22:37:32 +03:00
|
|
|
|
|
2026-05-23 08:52:52 +03:00
|
|
|
|
elif directive in ('.резб', '.резс', '.рездс', '.резкс'):
|
|
|
|
|
|
count = int(fields.get('count', '0'))
|
|
|
|
|
|
multiplier = {'резб': 1, 'резс': 2, 'рездс': 4, 'резкс': 8}
|
|
|
|
|
|
bnd_size += count * multiplier.get(directive, 1)
|
|
|
|
|
|
|
|
|
|
|
|
elif line_type == "LABEL":
|
|
|
|
|
|
label_name = fields.get('name', '')
|
|
|
|
|
|
sec = fields.get('section', '')
|
2026-05-11 15:08:03 +03:00
|
|
|
|
|
2026-05-23 08:52:52 +03:00
|
|
|
|
if sec == '.text':
|
|
|
|
|
|
addr = vaddr_text + text_pos
|
|
|
|
|
|
labels[label_name] = addr
|
|
|
|
|
|
label_sections[label_name] = sec
|
|
|
|
|
|
if label_name not in pending_labels:
|
|
|
|
|
|
pending_labels.append(label_name)
|
2026-05-11 15:08:03 +03:00
|
|
|
|
|
2026-05-23 08:52:52 +03:00
|
|
|
|
elif sec == '.data':
|
|
|
|
|
|
if vaddr_data is None:
|
|
|
|
|
|
vaddr_data = align_up(vaddr_text + text_pos, PAGE_SIZE)
|
|
|
|
|
|
addr = vaddr_data + data_pos
|
|
|
|
|
|
labels[label_name] = addr
|
|
|
|
|
|
label_sections[label_name] = sec
|
|
|
|
|
|
if label_name not in pending_labels:
|
|
|
|
|
|
pending_labels.append(label_name)
|
2026-05-17 22:37:32 +03:00
|
|
|
|
|
2026-05-23 08:52:52 +03:00
|
|
|
|
elif sec == '.бнд':
|
|
|
|
|
|
if vaddr_bnd is None:
|
|
|
|
|
|
vaddr_bnd = align_up(vaddr_data + data_pos, PAGE_SIZE)
|
|
|
|
|
|
addr = vaddr_bnd + bnd_size
|
|
|
|
|
|
labels[label_name] = addr
|
|
|
|
|
|
label_sections[label_name] = sec
|
|
|
|
|
|
if label_name not in pending_labels:
|
|
|
|
|
|
pending_labels.append(label_name)
|
2026-05-17 22:37:32 +03:00
|
|
|
|
|
2026-05-23 08:52:52 +03:00
|
|
|
|
else:
|
|
|
|
|
|
addr = current_address
|
|
|
|
|
|
labels[label_name] = addr
|
|
|
|
|
|
label_sections[label_name] = sec
|
|
|
|
|
|
if label_name not in pending_labels:
|
|
|
|
|
|
pending_labels.append(label_name)
|
|
|
|
|
|
|
|
|
|
|
|
elif line_type == "INSTR":
|
|
|
|
|
|
mnemonic = fields.get('mnemonic', '')
|
|
|
|
|
|
sec = fields.get('section', '')
|
|
|
|
|
|
operands = fields.get('operands', [])
|
2026-05-17 22:37:32 +03:00
|
|
|
|
|
2026-05-23 08:52:52 +03:00
|
|
|
|
source = f"{mnemonic} {', '.join(operands)}" if operands else mnemonic
|
2026-05-17 22:37:32 +03:00
|
|
|
|
|
2026-05-23 18:56:43 +03:00
|
|
|
|
need_stub = has_unresolved_labels(operands, mnemonic)
|
2026-05-17 22:37:32 +03:00
|
|
|
|
|
2026-05-23 18:56:43 +03:00
|
|
|
|
if need_stub:
|
2026-05-23 08:52:52 +03:00
|
|
|
|
stub_size = get_stub_size(mnemonic, operands)
|
|
|
|
|
|
unresolved = get_unresolved_labels(operands)
|
2026-05-23 18:56:43 +03:00
|
|
|
|
|
|
|
|
|
|
if unresolved:
|
|
|
|
|
|
reloc_text = f"ЗАГЛУШКА {', '.join(unresolved)}"
|
|
|
|
|
|
else:
|
|
|
|
|
|
label_from_op = extract_label_from_operands(operands)
|
|
|
|
|
|
if label_from_op:
|
|
|
|
|
|
reloc_text = f"ЗАГЛУШКА {label_from_op}"
|
|
|
|
|
|
else:
|
|
|
|
|
|
reloc_text = "ЗАГЛУШКА (неизвестная метка)"
|
2026-05-23 08:52:52 +03:00
|
|
|
|
|
|
|
|
|
|
relocations.append({
|
|
|
|
|
|
'address': current_address,
|
|
|
|
|
|
'size': stub_size,
|
2026-05-23 18:56:43 +03:00
|
|
|
|
'labels': unresolved if unresolved else [label_from_op] if label_from_op else [],
|
2026-05-23 08:52:52 +03:00
|
|
|
|
'source': source,
|
|
|
|
|
|
'mnemonic': mnemonic
|
|
|
|
|
|
})
|
|
|
|
|
|
|
|
|
|
|
|
for i in range(stub_size):
|
|
|
|
|
|
labels_list = pending_labels if i == 0 else None
|
|
|
|
|
|
add_byte(0xCC, source if i == 0 else "", reloc_text if i == 0 else None, labels_list)
|
|
|
|
|
|
if labels_list:
|
|
|
|
|
|
pending_labels = []
|
|
|
|
|
|
|
|
|
|
|
|
if sec == '.text':
|
|
|
|
|
|
text_buffer.extend([0xCC] * stub_size)
|
|
|
|
|
|
text_pos += stub_size
|
|
|
|
|
|
else:
|
|
|
|
|
|
data_buffer.extend([0xCC] * stub_size)
|
|
|
|
|
|
data_pos += stub_size
|
2026-05-17 22:37:32 +03:00
|
|
|
|
else:
|
2026-05-23 08:52:52 +03:00
|
|
|
|
try:
|
|
|
|
|
|
if sec == '.text':
|
|
|
|
|
|
current_pos = text_pos
|
|
|
|
|
|
else:
|
|
|
|
|
|
current_pos = data_pos
|
|
|
|
|
|
|
|
|
|
|
|
encoded = encode_instruction(
|
|
|
|
|
|
mnemonic, operands, labels, label_sections, symbols,
|
|
|
|
|
|
vaddr_text, vaddr_data if vaddr_data else 0,
|
|
|
|
|
|
current_pos, vaddr_bnd if vaddr_bnd else 0
|
|
|
|
|
|
)
|
|
|
|
|
|
|
|
|
|
|
|
for i, byte in enumerate(encoded):
|
|
|
|
|
|
labels_list = pending_labels if i == 0 else None
|
|
|
|
|
|
add_byte(byte, source if i == 0 else "", None, labels_list)
|
|
|
|
|
|
if labels_list:
|
|
|
|
|
|
pending_labels = []
|
|
|
|
|
|
|
|
|
|
|
|
if sec == '.text':
|
|
|
|
|
|
text_buffer.extend(encoded)
|
|
|
|
|
|
text_pos += len(encoded)
|
|
|
|
|
|
else:
|
|
|
|
|
|
data_buffer.extend(encoded)
|
|
|
|
|
|
data_pos += len(encoded)
|
|
|
|
|
|
|
|
|
|
|
|
except Exception as e:
|
|
|
|
|
|
print(f"Ошибка кодирования {source}: {e}", file=sys.stderr)
|
2026-05-23 18:56:43 +03:00
|
|
|
|
labels_to_attach = pending_labels.copy()
|
|
|
|
|
|
add_byte(0xCC, source, f"ОШИБКА: {e}", labels_to_attach)
|
|
|
|
|
|
pending_labels.clear()
|
2026-05-23 08:52:52 +03:00
|
|
|
|
|
|
|
|
|
|
if sec == '.text':
|
|
|
|
|
|
text_buffer.append(0xCC)
|
|
|
|
|
|
text_pos += 1
|
|
|
|
|
|
else:
|
|
|
|
|
|
data_buffer.append(0xCC)
|
|
|
|
|
|
data_pos += 1
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
def finalize_headers():
|
|
|
|
|
|
global entries
|
|
|
|
|
|
|
|
|
|
|
|
text_offset = 0x1000
|
|
|
|
|
|
data_offset = 0x2000
|
2026-05-02 23:04:46 +03:00
|
|
|
|
|
2026-05-23 08:52:52 +03:00
|
|
|
|
text_filesz = len(text_buffer)
|
|
|
|
|
|
text_memsz = len(text_buffer)
|
|
|
|
|
|
|
|
|
|
|
|
data_filesz = len(data_buffer)
|
|
|
|
|
|
data_memsz = len(data_buffer) + bnd_size
|
|
|
|
|
|
|
|
|
|
|
|
vaddr_data_final = align_up(vaddr_text + text_filesz, PAGE_SIZE)
|
|
|
|
|
|
entry_point_addr = labels.get(entry_point, vaddr_text)
|
|
|
|
|
|
|
|
|
|
|
|
i = 0
|
|
|
|
|
|
while i < len(entries):
|
2026-05-23 18:56:43 +03:00
|
|
|
|
segment, addr, virt_addr, byte_str, target, source, label, cmd_with_values, calc_target, calc_byte = entries[i]
|
2026-05-02 23:04:46 +03:00
|
|
|
|
|
2026-05-23 08:52:52 +03:00
|
|
|
|
if 'e_entry (stub)' in source:
|
2026-05-23 20:35:41 +03:00
|
|
|
|
# Вставляем 8 байт (uint64_t)
|
|
|
|
|
|
new_bytes = struct.pack('<Q', entry_point_addr)
|
2026-05-23 08:52:52 +03:00
|
|
|
|
for j, nb in enumerate(new_bytes):
|
2026-05-23 18:56:43 +03:00
|
|
|
|
virt = f"0x{entry_point_addr + j:08x}"
|
|
|
|
|
|
byte_hex = f"0x{nb:02x}"
|
|
|
|
|
|
entries[i + j] = (segment, addr + j, virt, byte_hex, target,
|
2026-05-23 08:52:52 +03:00
|
|
|
|
f"e_entry = 0x{entry_point_addr:x}",
|
|
|
|
|
|
label if j == 0 else "",
|
2026-05-23 18:56:43 +03:00
|
|
|
|
"", "", byte_hex)
|
2026-05-23 08:52:52 +03:00
|
|
|
|
i += 8
|
|
|
|
|
|
continue
|
2026-05-02 23:04:46 +03:00
|
|
|
|
|
2026-05-23 08:52:52 +03:00
|
|
|
|
elif 'p_offset (text stub)' in source:
|
2026-05-23 20:35:41 +03:00
|
|
|
|
new_bytes = struct.pack('<Q', text_offset)
|
2026-05-23 08:52:52 +03:00
|
|
|
|
for j, nb in enumerate(new_bytes):
|
2026-05-23 18:56:43 +03:00
|
|
|
|
virt = f"0x{addr + j:08x}"
|
|
|
|
|
|
byte_hex = f"0x{nb:02x}"
|
|
|
|
|
|
entries[i + j] = (segment, addr + j, virt, byte_hex, target,
|
2026-05-23 08:52:52 +03:00
|
|
|
|
f"p_offset (text) = 0x{text_offset:x}",
|
|
|
|
|
|
label if j == 0 else "",
|
2026-05-23 18:56:43 +03:00
|
|
|
|
"", "", byte_hex)
|
2026-05-23 08:52:52 +03:00
|
|
|
|
i += 8
|
|
|
|
|
|
continue
|
2026-05-02 23:04:46 +03:00
|
|
|
|
|
2026-05-23 08:52:52 +03:00
|
|
|
|
elif 'p_filesz (text stub)' in source:
|
2026-05-23 20:35:41 +03:00
|
|
|
|
new_bytes = struct.pack('<Q', text_filesz)
|
2026-05-23 08:52:52 +03:00
|
|
|
|
for j, nb in enumerate(new_bytes):
|
2026-05-23 18:56:43 +03:00
|
|
|
|
virt = f"0x{addr + j:08x}"
|
|
|
|
|
|
byte_hex = f"0x{nb:02x}"
|
|
|
|
|
|
entries[i + j] = (segment, addr + j, virt, byte_hex, target,
|
2026-05-23 08:52:52 +03:00
|
|
|
|
f"p_filesz (text) = {text_filesz}",
|
|
|
|
|
|
label if j == 0 else "",
|
2026-05-23 18:56:43 +03:00
|
|
|
|
"", "", byte_hex)
|
2026-05-23 08:52:52 +03:00
|
|
|
|
i += 8
|
|
|
|
|
|
continue
|
2026-05-02 23:04:46 +03:00
|
|
|
|
|
2026-05-23 08:52:52 +03:00
|
|
|
|
elif 'p_memsz (text stub)' in source:
|
2026-05-23 20:35:41 +03:00
|
|
|
|
new_bytes = struct.pack('<Q', text_memsz)
|
2026-05-23 08:52:52 +03:00
|
|
|
|
for j, nb in enumerate(new_bytes):
|
2026-05-23 18:56:43 +03:00
|
|
|
|
virt = f"0x{addr + j:08x}"
|
|
|
|
|
|
byte_hex = f"0x{nb:02x}"
|
|
|
|
|
|
entries[i + j] = (segment, addr + j, virt, byte_hex, target,
|
2026-05-23 08:52:52 +03:00
|
|
|
|
f"p_memsz (text) = {text_memsz}",
|
|
|
|
|
|
label if j == 0 else "",
|
2026-05-23 18:56:43 +03:00
|
|
|
|
"", "", byte_hex)
|
2026-05-23 08:52:52 +03:00
|
|
|
|
i += 8
|
|
|
|
|
|
continue
|
2026-05-02 23:04:46 +03:00
|
|
|
|
|
2026-05-23 08:52:52 +03:00
|
|
|
|
elif 'p_offset (data stub)' in source:
|
2026-05-23 20:35:41 +03:00
|
|
|
|
new_bytes = struct.pack('<Q', data_offset)
|
2026-05-23 08:52:52 +03:00
|
|
|
|
for j, nb in enumerate(new_bytes):
|
2026-05-23 18:56:43 +03:00
|
|
|
|
virt = f"0x{addr + j:08x}"
|
|
|
|
|
|
byte_hex = f"0x{nb:02x}"
|
|
|
|
|
|
entries[i + j] = (segment, addr + j, virt, byte_hex, target,
|
2026-05-23 08:52:52 +03:00
|
|
|
|
f"p_offset (data) = 0x{data_offset:x}",
|
|
|
|
|
|
label if j == 0 else "",
|
2026-05-23 18:56:43 +03:00
|
|
|
|
"", "", byte_hex)
|
2026-05-23 08:52:52 +03:00
|
|
|
|
i += 8
|
|
|
|
|
|
continue
|
|
|
|
|
|
|
|
|
|
|
|
elif 'p_vaddr (data stub)' in source:
|
2026-05-23 20:35:41 +03:00
|
|
|
|
new_bytes = struct.pack('<Q', vaddr_data_final)
|
2026-05-23 08:52:52 +03:00
|
|
|
|
for j, nb in enumerate(new_bytes):
|
2026-05-23 18:56:43 +03:00
|
|
|
|
virt = f"0x{vaddr_data_final + j:08x}"
|
|
|
|
|
|
byte_hex = f"0x{nb:02x}"
|
|
|
|
|
|
entries[i + j] = (segment, addr + j, virt, byte_hex, target,
|
2026-05-23 08:52:52 +03:00
|
|
|
|
f"p_vaddr (data) = 0x{vaddr_data_final:x}",
|
|
|
|
|
|
label if j == 0 else "",
|
2026-05-23 18:56:43 +03:00
|
|
|
|
"", "", byte_hex)
|
2026-05-23 08:52:52 +03:00
|
|
|
|
i += 8
|
|
|
|
|
|
continue
|
|
|
|
|
|
|
|
|
|
|
|
elif 'p_paddr (data stub)' in source:
|
2026-05-23 20:35:41 +03:00
|
|
|
|
new_bytes = struct.pack('<Q', vaddr_data_final)
|
2026-05-23 08:52:52 +03:00
|
|
|
|
for j, nb in enumerate(new_bytes):
|
2026-05-23 18:56:43 +03:00
|
|
|
|
virt = f"0x{vaddr_data_final + j:08x}"
|
|
|
|
|
|
byte_hex = f"0x{nb:02x}"
|
|
|
|
|
|
entries[i + j] = (segment, addr + j, virt, byte_hex, target,
|
2026-05-23 08:52:52 +03:00
|
|
|
|
f"p_paddr (data) = 0x{vaddr_data_final:x}",
|
|
|
|
|
|
label if j == 0 else "",
|
2026-05-23 18:56:43 +03:00
|
|
|
|
"", "", byte_hex)
|
2026-05-23 08:52:52 +03:00
|
|
|
|
i += 8
|
|
|
|
|
|
continue
|
|
|
|
|
|
|
|
|
|
|
|
elif 'p_filesz (data stub)' in source:
|
2026-05-23 20:35:41 +03:00
|
|
|
|
new_bytes = struct.pack('<Q', data_filesz)
|
2026-05-23 08:52:52 +03:00
|
|
|
|
for j, nb in enumerate(new_bytes):
|
2026-05-23 18:56:43 +03:00
|
|
|
|
virt = f"0x{addr + j:08x}"
|
|
|
|
|
|
byte_hex = f"0x{nb:02x}"
|
|
|
|
|
|
entries[i + j] = (segment, addr + j, virt, byte_hex, target,
|
2026-05-23 08:52:52 +03:00
|
|
|
|
f"p_filesz (data) = {data_filesz}",
|
|
|
|
|
|
label if j == 0 else "",
|
2026-05-23 18:56:43 +03:00
|
|
|
|
"", "", byte_hex)
|
2026-05-23 08:52:52 +03:00
|
|
|
|
i += 8
|
|
|
|
|
|
continue
|
|
|
|
|
|
|
|
|
|
|
|
elif 'p_memsz (data stub)' in source:
|
2026-05-23 20:35:41 +03:00
|
|
|
|
new_bytes = struct.pack('<Q', data_memsz)
|
2026-05-23 08:52:52 +03:00
|
|
|
|
for j, nb in enumerate(new_bytes):
|
2026-05-23 18:56:43 +03:00
|
|
|
|
virt = f"0x{addr + j:08x}"
|
|
|
|
|
|
byte_hex = f"0x{nb:02x}"
|
|
|
|
|
|
entries[i + j] = (segment, addr + j, virt, byte_hex, target,
|
2026-05-23 08:52:52 +03:00
|
|
|
|
f"p_memsz (data) = {data_memsz}",
|
|
|
|
|
|
label if j == 0 else "",
|
2026-05-23 18:56:43 +03:00
|
|
|
|
"", "", byte_hex)
|
2026-05-23 08:52:52 +03:00
|
|
|
|
i += 8
|
|
|
|
|
|
continue
|
|
|
|
|
|
|
|
|
|
|
|
i += 1
|
2026-05-02 23:04:46 +03:00
|
|
|
|
|
|
|
|
|
|
|
2026-05-23 08:52:52 +03:00
|
|
|
|
def save_to_csv(filename: str):
|
|
|
|
|
|
with open(filename, 'w', newline='', encoding='utf-8') as f:
|
|
|
|
|
|
writer = csv.writer(f, delimiter=';')
|
2026-05-23 18:56:43 +03:00
|
|
|
|
writer.writerow(['сегмент', 'адрес', 'виртуальный_адрес', 'байт', 'приводящая_метка',
|
|
|
|
|
|
'уводящий_адрес', 'исходная_команда', 'команда_со_значениями',
|
2026-05-23 08:52:52 +03:00
|
|
|
|
'рассчитанный_уводящий_адрес', 'рассчитанный_байт'])
|
|
|
|
|
|
|
2026-05-23 18:56:43 +03:00
|
|
|
|
for segment, addr, virt_addr, byte_str, target, source, label, cmd_with_values, calc_target, calc_byte in entries:
|
2026-05-23 08:52:52 +03:00
|
|
|
|
writer.writerow([
|
|
|
|
|
|
segment,
|
|
|
|
|
|
f"0x{addr:08x}",
|
2026-05-23 18:56:43 +03:00
|
|
|
|
virt_addr,
|
|
|
|
|
|
byte_str,
|
2026-05-23 08:52:52 +03:00
|
|
|
|
label,
|
|
|
|
|
|
target,
|
|
|
|
|
|
source,
|
2026-05-23 18:56:43 +03:00
|
|
|
|
cmd_with_values,
|
2026-05-23 08:52:52 +03:00
|
|
|
|
calc_target,
|
|
|
|
|
|
calc_byte
|
|
|
|
|
|
])
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
def main():
|
2026-05-02 23:04:46 +03:00
|
|
|
|
if len(sys.argv) != 3:
|
2026-05-23 08:52:52 +03:00
|
|
|
|
print("Использование: python kvs_pass1.py <вход.аст> <выход.csv>")
|
2026-05-02 23:04:46 +03:00
|
|
|
|
sys.exit(1)
|
|
|
|
|
|
|
2026-05-23 08:52:52 +03:00
|
|
|
|
ast_file = sys.argv[1]
|
|
|
|
|
|
csv_file = sys.argv[2]
|
|
|
|
|
|
|
|
|
|
|
|
reset_state()
|
|
|
|
|
|
|
|
|
|
|
|
set_segment('.header')
|
|
|
|
|
|
generate_elf_header()
|
|
|
|
|
|
generate_program_headers()
|
|
|
|
|
|
align_to(PAGE_SIZE)
|
|
|
|
|
|
|
|
|
|
|
|
ast_lines = read_ast(ast_file)
|
2026-05-02 23:04:46 +03:00
|
|
|
|
for line in ast_lines:
|
2026-05-23 08:52:52 +03:00
|
|
|
|
process_ast_line(line)
|
2026-05-02 23:04:46 +03:00
|
|
|
|
|
2026-05-23 08:52:52 +03:00
|
|
|
|
finalize_headers()
|
|
|
|
|
|
save_to_csv(csv_file)
|
2026-05-17 16:15:27 +03:00
|
|
|
|
|
2026-05-23 08:52:52 +03:00
|
|
|
|
vaddr_data_final = align_up(vaddr_text + len(text_buffer), PAGE_SIZE)
|
|
|
|
|
|
vaddr_bnd_final = align_up(vaddr_data_final + len(data_buffer), PAGE_SIZE)
|
|
|
|
|
|
|
2026-05-23 18:56:43 +03:00
|
|
|
|
print(f"\n=== Первый проход ===")
|
|
|
|
|
|
print(f" .text: {len(text_buffer)} байт, vaddr=0x{vaddr_text:x}")
|
|
|
|
|
|
print(f" .data: {len(data_buffer)} байт, vaddr=0x{vaddr_data_final:x}")
|
|
|
|
|
|
print(f" .bnd: {bnd_size} байт, vaddr=0x{vaddr_bnd_final:x}")
|
2026-05-23 08:52:52 +03:00
|
|
|
|
print(f" точка входа: {entry_point} = 0x{labels.get(entry_point, vaddr_text):x}")
|
|
|
|
|
|
print(f" меток: {len(labels)}")
|
|
|
|
|
|
print(f" констант: {len(symbols)}")
|
|
|
|
|
|
print(f" релокаций: {len(relocations)}")
|
2026-05-23 18:56:43 +03:00
|
|
|
|
print(f" записей: {len(entries)}")
|
|
|
|
|
|
print(f" CSV: {csv_file}")
|
2026-05-23 08:52:52 +03:00
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
if __name__ == "__main__":
|
|
|
|
|
|
main()
|