Что такое CSV файл и как он помогает экспортировать и импортировать данные в Интернет-магазине? Как открыть в Excel файл CSV с разделителем запятая? Как прочитать файл csv.

Чтобы узнать чем открыть файл CSV формата, следует перейти к списку установленных программ на вашем компьютере. Если там есть MS Excel, почтовый клиент Microsoft Outlook или любой текстовый редактор – загружайте документ в него. Так как офисный пакет Microsoft установлен практически на каждом ПК – софт из него мы назвали в первую очередь. Вы же можете опробовать и другие приложения:

  • Microsoft Works
  • Notepad
  • Corel Quattro Pro
  • IBM Lotus Symphony
  • KSpread
  • LabVIEW

Как открыть файл CSV в Excel

id="a1">

Для того чтобы программа для создания таблиц правильно расшифровала этот документ, следует выполнить одну хитрость: открыть файл в любом текстовом редакторе и написать в первой строке «sep=». Все, теперь приложение опознает разделитель в виде запятой и корректно отобразит содержимое!

Что находится в файле CSV

id="a2">

Это обычный текстовый формат для табличных данных. Каждая строчка – это одна строка в таблице. Значения в отдельных колонках разделяются запятой. Так как это расширение поддерживается многими программами, CSV-файлы можно использовать для импорта или экспорта табличных данных между различными компьютерными приложениями, например электронной таблицей и базой данных.

Показать видеоинструкцию

На самом деле, вопрос не столь уж и тривиален, как может показаться на первый взгляд. Формат CSV , как следует из его названия, подразумевает использование в качестве разделителя символ запятой (,) . Однако, многие программы и сервисы допускают использованием и других символов. К таковым можно отнести и MS Excel, особенно если речь идёт о русифицированной его версии. В данной статье я хочу привести решение проблемы с открытием CSV-файла экспорта из Google инструмента для веб-мастеров в MS Excel. Впрочем, тема актуально и для других вариантов.

  • Проблема экспорта поисковых запросов (ПЗ) из Google вебмастер
    • Проблема с кодировкой
    • Разделитель запятая в CSV
    • То, что помогло
  • Подведём итоги

Проблема экспорта ПЗ из Google вебмастер

Многие из нас используют Google инструмент для веб-мастеров только для добавления сайта. Это неправильно, здесь есть масса полезной информации, например список поисковых запросов, по которым пользователи находят и заходят на сайт. Смотрите отчет: Поисковый трафик > Поисковые запросы - предварительно выбрав нужный сайт в списке.

Здесь же есть и экспорта данных в CSV-формате, с возможностью его открытия в Google Таблицы (онлайн аналог Excel) . Ищите кнопку «Загрузить эту таблицу ». К слову, количество отображаемых запросов на странице не влияет на полноту экспортируемых данных.

Проблема в том, что в CSV-файле используется разделитель запятой и кодировка UTF-8. Так что даже в Google Таблицы, вместо кириллицы, вы получите только набор вопросов.

Другими словами, нам нужно изменить кодировку на ANSI. А для открытия файла CSV в Excel заменить и разделитель запятой (,) на символ точки с запятой (;) .

CSV с разделителем запятая в UTF-8

Проблема с кодировкой

Проще всего решить проблему с кодировкой . Для этого вы можете использовать любой текстовый редактор с этой функцией, например Notepad++. Его вы можете скачать бесплатно на официальном сайте: unotepad-plus-plus.org . Далее запускаем редактор и открываем в нём наш CSV-файл, а потом кликаем пункт меню «Кодировки » и меняем на нужную, т.е. пункт «Преобразовать в ANSI ».

У меня на картинке показан обратный процесс: преобразования из ANSI в UTF-8 - но, думаю, вы это и сами заметилии, а принцип тот же.

Разделитель запятая в CSV

Теперь, что касается разделителя запятой . По сути, для Google Таблиц что-то менять не надо. Да и в англоязычной версии MS Excel это может прокатить, проверьте. Тем не менее, если нужна замена, то здесь следует учесть, что просто заменить запятую (,) на символ точки с запятой (;) не получится, т.к. в файле могут быть значения, содержащие этот символ. Они обычно помещены в кавычки. Например:

значение,1,"значение, с запятой",

По идее здесь должна помочь настройка самой операционной системы Windows: Пуск > Панель управления > Язык и региональные стандарты . На вкладке «Форматы» кликаем кнопку «Изменить этот формат… » В открывшемся окне, на вкладке «Числа» замените «Разделитель элементов списка » на нужный, т.е. символ точки с запятой (;) меняем на запятую (,) .

Правда, у меня это не сработало. Да и менять настройки операционной системы, как по мне, дело не благодатное. Тем не менее, я решил указать этот вариант решения проблемы, т.к. на большинстве специализированных форумов ссылаются именно на него.

То, что помогло

Увы, но какой-то дополнительной обработки файлов с расширением.csv в MS Excel я не нашел. Тем не менее, есть возможность обработки, но только в том случае, если сменить расширение файла, например, на.txt . Так что меняем расширение файла и открываем его в Excel.

Появится окно «Мастер текстов (импорт)». Здесь вы можете выбрать формат исходных данных, начальную строку импорта и кодировку файла (нам нужна 1251: Cyrillic) . К слову, почему нужно было менять кодировку, когда её можно выбрать в мастере? Потому, что кодировки UTF-8, по крайней мере у меня, здесь нету. Кликаем кнопку «Далее ».

На следующем шаге мы можем выбрать символ-разделитель, причем несколько. Ставим галочку «запятая » и убираем галочку «знак табуляции ». Здесь же можно выбрать и символ ограничителя строк. Это тот, что используется для значений, в которых присутствуют спецсимволы (двойные кавычки, запятая, точка с запятой, новая строка и т.д.) . Вариант с двойной кавычкой, в моём случае, это то, что надо. Обратите внимание на поле «Образец разбора данных», данные стали таблицей. Кликаем кнопку «Далее ».

На последнем шаге можно указать формат данных столбцов, правда выбор здесь не велик: общий (по умолчанию) , текстовый, дата и пропустить столбец. Последний вариант представляется мне наиболее интересным, т.к. позволяет сразу исключить ненужные столбцы. Просто выберите соответствующий столбец и кликните для него вариант «пропустить столбец ». Кликаем кнопку «Готово ».

Excel сформирует нужную нам таблицу, где мы можем задать нужную ширину столбцов и формат ячеек, но это уже совсем другая история. Отмечу лишь, что есть проблема с распознанием тех же процентов.

Онлайн сервис для нормализации CSV-файлов

Впрочем, все выше изложенные проблемы решает простой онлайн сервис Normalization CSV . Он позволяет менять кодировку и символ разделителя. Правда существует ограничение в 64 000 байтов (сколько это в Кб?) для загружаемого файла, но CSV-файлы обычно весят не очень много, должно хватить. Результат обработки выводится как обычный текстовый файл, его можно сохранить с расширением.csv .

К слову, скрипт преобразовавает значение процентов, например: 95 % - в нужное значение для столбца «проценты» в Excel, т.е. делится на 100 и получаем число с плавающей запяток, например: 0,95 . Если нужны ещё какие-то преобразования: пишите, попробуем доработать.

Ну, а если предложенный онлайн сервис вас не устраивает, вы всегда можете воспользоваться выше приведённой инструкцией.

Подведём итоги

Некоторые онлайн сервисы предоставляют возможность экспорта данных в просто и удобном CSV-формате. Как следует из названия, подразумевает использование в качестве разделителя символ запятой (,) . Однако, многие приложения трактуют этот формат несколько своевольно, что приводит к закономерным проблемам. К тому же сейчас всё более популярна кодировка UTF-8, в то время как Excel или Google Таблицы используют ANSI.

Решить проблему с кодировкой поможет, к примеру, Notepad++, а для того, чтобы разобраться с разделителем, достаточно изменить расширение файла на.txt и воспользоваться мастером текстов в Excel. Впрочем, все эти задачи способен решить бесплатный онлайн сервис Normalization CSV , правда стоит учесть его ограничение на объём загружаемого файла. На этом у меня всё. Спасибо за внимание. Удачи!

в 19:44 Изменить сообщение 16 комментариев

Файл с расширением «csv» - это текстовый документ, который используется для представления и обработки данных в различных программных продуктах. Структура файла «csv» представляет собой строки, разделенные запятыми. Каждая строка является строкой в таблице, а запятые служат для разделения этих строк на колонки.

На заметку!

История создания файла берет начало с 1967 года. Тогда этот формат впервые начал использоваться для компьютеров IBM под управлением операционной системы OS/360. Несмотря на довольно большой срок службы такого формата, он до сих пор не утратил свою актуальность и используется в табличных процессорах и программах, которые обрабатывают базы данных.

Какой программой открыть файл csv?

Формат документа «csv» является обычным текстовым файлом. Чтобы быстро его отредактировать, вам всего лишь потребуется блокнот или бесплатный текстовый редактор Notepad++. Скачать его можно . Пример открытия в программе Notepad++ изображён на рисунке ниже.

На заметку!

Блокнот удобен в том случае, если вам следует отредактировать небольшой файл. Но если в файле много данных, удобней всего воспользоваться табличным процессором.

Наиболее популярными табличными процессорами являются:

  • Gnumeric;
  • Microsoft Excel;
  • LibreOffice Calc;
  • OpenOffice Calc;
  • Kingsoft Spreadsheets.

Например, LibreOffice можно скачать с официального сайта .

Кроме табличных редакторов файл «csv» используется в различном специализированном ПО, которое хранит в нем данные. Также, компания Google использует в своих продуктах этот формат для импорта и экспорта контактов в Gmail.

Как открыть csv файл?

Теперь разберемся на подробном примере открытия «csv» файла. Для этого воспользуемся табличным редактором LibreOffice Calc, который входит в бесплатный офисный пакет LibreOffice:


Надеемся, с нашей статьей вы сможете разобраться с данной проблемой. Вопросы оставляйте в комментариях!

Для начала разберемся, что такое CSV файл . CSV - это текстовый формат представления табличных данных, который в переводе с английского (Comma-Separated Values ) обозначает значения, разделенные запятыми. Каждая строка такого файла CSV представляет собой одну строку таблицы, в которой содержатся все значения столбцов, которые заключены в кавычки, а разделителями значений столбцов выступают запятые. Разделителями в файле CSV могут выступать и другие символы, такие как табуляция (TSV файлы), точка запятой (SCSV файлы) и другие. В данной статье мы рассмотрим на примере, как открыть CSV файл в Excel .

При экспортировании информации из базы данных в формат CSV , ее необходимо открыть в удобочитаемом виде, например, для дальнейшего анализа, написания отчета или просмотра статистики. В этом нам поможет текстовый редактор Excel, с помощью которого мы импортируем файл CSV в Excel .

Как открыть CSV в Excel

Перейдем к примеру, в котором рассмотрим, как открыть CSV файл в Excel . Пусть у нас есть файл CSV формата , который будет выглядеть следующим образом, если его просто открыть с помощью Excel или другого текстового редактора.

Как открыть CSV в Excel - Неформатированный файл CSV в Excel

Для того чтобы представить данные из CSV файла в удобном виде, в виде таблицы, необходимо импортировать файл CSV в Excel . Разберем как вставить данные из CSV файла в открытую рабочую книгу Excel.

  1. Перейдите во вкладку «Данные », и в группе «Получение внешних данных » выберите пункт «Из текста ».

Как открыть CSV в Excel - Получение внешних данных из текста в Excel
  1. В открывшемся окне найдите в вашем компьютере CSV файл, который хотите открыть в Excel. Выберите его и нажмите кнопку «Импорт » либо дважды кликните по файлу.

Как открыть CSV в Excel - Импорт CSV файла в Excel
  1. Далее появится окно мастера импорта текстов.

Шаг 1. В поле «Формат исходных данных » у нас должен быть выбран пункт «с разделителями », так как в текстовом файле CSV элементы разделены запятыми .

В поле «Начать импорт со строки » мы указываем номер первой строки импортируемых данных. В нашем случае начнем с первой строки. И нажимаем кнопку «Далее ».

Как открыть CSV в Excel - Импорт CSV файла. Шаг 1
  1. Шаг 2. На втором этапе мы выбираем разделители и ограничители строк.

В поле «Символом-разделителем является :» мы выбираем символ, который разделяет значения в текстовом файле CSV . В нашем случае это запятая . Если в вашем CSV файле разделителями выступают другие символы, или он отсутствует в списке, то выбирайте пункт «другой :» и введите его в поле.

В поле «Ограничитель строк » мы выбираем “ . Нажимаем кнопку «Далее ».

Как открыть CSV в Excel - Импорт CSV файла. Шаг 2

Разберемся в каких случаях нужно выбирать определенный вид ограничителя строк.

Когда разделителем выступает запятая (,), а ограничитель строк - кавычки ("), текст "Иванов, бухгалтер" будет импортирован в Excel в одну ячейку как Иванов, бухгалтер. Если ограничителем строк выступает одинарная кавычка или он не задан, то текст "Иванов, бухгалтер", импортированный в Excel будет разбит на две ячейки как "Иванов", "бухгалтер ".

  1. Шаг 3. В группе «Формат данных столбца » задаем формат данных для каждого столбца в предпросмотре «Образец разбора данных ».

Как открыть CSV в Excel - Импорт CSV файла. Шаг 3

В случае, если какой-то столбец не нужно импортировать из CSV файла выберите пункт пропустить .

Как открыть CSV в Excel - Пропустить столбец при импорте CSV в Excel

Нажимаем кнопку «Готово ».

  1. После мастера импорта текста появится окно «Импорт данных »:

Как открыть CSV в Excel - Окно «Импорт данных»

В группе «Куда следует поместить данные » выбираем расположение наших импортируемых данных из CSV в Excel . Если выбираем поле «Имеющийся лист », то указываем адрес ячейки. А если хотим расположить на новом листе, то - пункт «Новый лист ». Мы выберем «Имеющийся лист ». Нажимаем кнопку «ОК ».

В итоге мы получили вот такую таблицу:

Как открыть CSV в Excel - CSV файл в Excel

Ну вот и все, теперь вы с легкостью можете открыть CSV в Excel , и далее работать с полученными табличными данными привычными инструментами MS Excel.

Министерство образования и науки Российской Федерации

Государственное бюджетное учреждение высшего профессионального образования

Новосибирский государственный технический университет

Кафедра СИТ

Расчетно-графическая работа

по дисциплине

«Сетевые информационные технологии»

Формат данных CSV

Группа: АВТ-909

Выполнил: Гоголи А.Г.

Преподаватель:

Хайретдинов М.С.

Новосибирск, 2013

Задание. 3

1. Введение. 4

2. Общие сведения. 5

3. Структура данных в файле. 6

3.1. Записи. 6

3.2. Поля (столбцы) 6

3.2 Разделители. 7

3.3 Маркер конца записи. 7

4. Запись заголовка. 9

5. Защита поля данных. 9

5.1 Двойные кавычки для защиты.. 9

5.2 Двухместный двойные кавычки. 10

6. Пример реализации. 11

7. Библиотеки для работы с форматом.. 12

8. Тестовая программа. 13

Литература. 14


Задание

1. Изучить и написать обзор формата CSV.

2. Написать обзор имеющихся в сети бесплатно распространяемых библиотек, реализующих чтение/запись данных в указанном формате/языке описания или пересылку данных для указанного протокола или интерфейса I/O и стыкуемых с модулями на С/С++.

3. Написать процедуру чтения данных в указанном формате.

4. Написать процедуру записи данных в указанном формате.

5. Написать функцию приема/передачи данных с использованием указанного протокола или интерфейса I/O.

6. Составить тестовые наборы данных для проверки всех видов элементов данных, используемых в указанном формате.


1. Введение

CSV (от англ. Comma-Separated Values - значения, разделённые запятыми) - текстовый формат, предназначенный для представления табличных данных. Каждая строка файла - это одна строка таблицы. Значения отдельных колонок разделяются разделительным символом (delimiter) -запятой(,).

CSV-файл можно рассматривать как хранилище данных от приложения производителя до считывания приложением потребителя. Их основная функция заключается в хранении текстовых данных и не предназначены для двоичных данных.


2. Общие сведения

CSV файл состоит из двух типов данных: полезных данных и маркеров. Полезные данные это то, что записывается в приложении производителя и считывается в приложении потребителя. Маркеры используются для организации полезных данных внутри файл CSV.

Следующие правила применяются для всех файлов CSV:

1 Расширение файла должно быть *.csv независимо от вида маркеров.

Это гарантирует правильное считывание файла вместе с маркерами. Три общих 8-битные кодировки: 1252, ISO / IEC 8859-1 и UTF-8.

3 Кроме маркеров ничего не должно быть записано в кодировке ASCII.

Файл CSV не предназначено для хранения двоичных данных. Это правило запрещает использование большинства управляющих символов ASCII.

4 CSV-файл должен содержать хотя бы одну запись.

CSV файл не должен быть пустым (иметь нулевую длину) или состоять только из логического конца. Минимальное количество записей, которые должен содержать CSV файл, это одна запись - заголовок, за которым может следовать 0 и более записей данных.


3. Структура данных в файле

3.1. Записи.

Запись в CSV файле состоит из двух частей: основные данные с разделителями и маркера конца записи. (рис.1)

Рисунок 1. Структура записей в CSV-файле.

3.2. Поля (столбцы)

CSV, как правило, используются для хранения однородных табличных данных. При просмотре в таблице, данные внутри CSV визуально расположены в несколько строк (записей) и столбцов (полей). Отсюда и термин поле столбца.

При фиксированной длине поля относительное местоположение каждого поля внутри записи должно быть фиксировано. Однако, CSV это формат файлов, который позволяет записи переменной длины. Это дает возможность сэкономить значительные пространства по сравнению с форматами фиксированной длины. Для реализации данного подхода используется маркер разделения полезных данных, который указывает на переход от одного поля к другому. Разделителем полей является один символ.

Так же присутствует запись заголовка. Поэтому очень важно, что бы поля в записи следовали в заданном порядке.

На рис.2 показано, где используются символы разделения (SEP) в записи. Вся запись может состоять только из разделителей.

Рисунок 2. Формат записи в CSV-файле.

3.2 Разделители

Хотя имя файла формата Comma-Separated Values - значения, разделённые запятыми предполагает в виде разделителя полей запятую, некоторые приложения используют и другие символы.

Следующие правила применяются для разделителя:

1 Разделитель полей должен быть одним символом.

2 После выбора символа, тот же символ должен использоваться на протяжении всего файла.

3 Производитель приложение должен использовать запятую (ASCII 0x2C) в качестве разделителя полей.

Это правило поднимает один из самых сложных вопросов, с которыми сталкиваются разработчики при реализации кода для обработки файла CSV: разделители, встроенные в полезные данные.

Loading...Loading...