Hallo,
ich suche nach der Einstellung für das Feldformat beim Import von html-Dateien. In der zu importierenden Datei befinden sich in einigen Feldern Rufnummern, die entweder mit 0 oder mit + beginnen. Beim Import werden die führenden Nullen einfach nicht mit übernommen. Bei den Feldern mit + wird eine E-Funktion dargestellt.
Leider finde ich nirgendwo eine Möglichkeit, diese Felder von vorneherein als Text zu definieren, damit mir die Daten mit 0 und + bleiben.
ich suche nach der Einstellung für das Feldformat beim Import
von html-Dateien. In der zu importierenden Datei befinden sich
in einigen Feldern Rufnummern, die entweder mit 0 oder mit +
beginnen. Beim Import werden die führenden Nullen einfach
nicht mit übernommen. Bei den Feldern mit + wird eine
E-Funktion dargestellt.
Leider finde ich nirgendwo eine Möglichkeit, diese Felder von
vorneherein als Text zu definieren, damit mir die Daten mit 0
und + bleiben.
Hi Sabine,
ein Tipp, probiere mal den Import mittels Open Office, may be da gibt es so Einstellungen.
Wenn das nicht hilft, brauchst du ein Mako was die Htmlseite ausliest und die Htmlt-Tags entfernt.
Schau mal hier:
http://groups.google.de/groups?q=excel%20html%20sub&…
Ggfs die Suchwörter variieren mit
auslesen, imortieren Seite
usw um die Trefferanzahl zu mindern.
Oder suche erst mal hier, nur 52 Treffer:
http://groups.google.de/groups/search?ie=UTF-8&oe=UT…
Wennn du da ein Html2Txt Code findest kannst du den ja mal ausprobieren, dann liegt die Html zumindest schon mal als Txt.Datei vor, ist schon mal ein Schrtt weiter.
Gruß
Reinhard
Hallo Reinhard,
das mit dem OO klappt leider nicht. Auf meinem Dienst-PC darf nix anderes drauf.
Aber die Idee mit dem HTML2TXT ist gut. Das probier ich mal.
Danke
das mit dem OO klappt leider nicht. Auf meinem Dienst-PC darf
nix anderes drauf.
Aber die Idee mit dem HTML2TXT ist gut. Das probier ich mal.
Hi Sabine,
bei OO vertraue ich sehr auf die sehr vielen ehrenamtlichen und deshalb viel engagierteren Programmierer (An dieser Stelle mal ein dickes Sternchen für diese Leute) als bei MS.
Viele fachkundige Augen haben ein wachsames Auge auf den offenen Quellcode von OO und passen schon auf dass da keiner was übles reinschmuggelt, d.h. alle neuen Codezeilen werden mehrfach geprüft.
Und ich würde mit dem Admin reden dass er OO installiert.
Immerhin gibt es für wichtige Firmendateien die MS-Office nicht mehr öfnen kann noch die kleine aber durchaus vorhandene Möglichkeit, dass OO die Datei öffnen kann. Allein das ist schon ein Argument.
Gruß
Reinhard
Hallo Reinhard,
leider ist der Laden hier viel zu groß und zu träge, als das wir hier erreichen könnten, das OO installiert wird.
Die Idee mit dem html2txt ist leider auch gescheitert.
Jetzt versuch ich mir grad ein Macro zu schreiben, das ich es in ein Format bekomme, mit dem ich was anfangen kann.
Das bedeutet dummerweise viel Zeit in Bastelei zu stecken, die ich eigentlich nicht habe.
Aber trotzdem danke für Deine Hilfe, sehr nett.
Gruß
Sabine
Html Internetseite auslesen
leider ist der Laden hier viel zu groß und zu träge, als das
wir hier erreichen könnten, das OO installiert wird.
Die Idee mit dem html2txt ist leider auch gescheitert.
Jetzt versuch ich mir grad ein Macro zu schreiben, das ich es
in ein Format bekomme, mit dem ich was anfangen kann.
Das bedeutet dummerweise viel Zeit in Bastelei zu stecken, die
ich eigentlich nicht habe.
Hi Sabine,
vielleicht sparste dadurch ein bisschen Zeit 
Code ist von Rud, wer auch immer das ist.
Option Explicit
Sub lesen()
Open "C:\www.txt" For Output As #1
'Print #1, GetInnerX("http://www.wer-weiss-was.de", "HTML")
Print #1, GetInnerX("http://www.wer-weiss-was.de", "")
Close 1
End Sub
Function GetInnerX(strURL As String, Optional strWhat As String = "HTML") As String
Dim objIE As Object, objDoc As Object
Dim strMldg As String
GetInnerX = ""
On Error GoTo ErrorHandler 'evtl. Fehler (auch serverseitig) abfangen
Set objIE = CreateObject("InternetExplorer.Application")
objIE.Visible = False
objIE.Navigate strURL
Do While objIE.Busy
Loop
Set objDoc = objIE.Document
Do While objDoc.readyState "complete"
Loop
Select Case UCase(strWhat)
Case "HTML"
GetInnerX = objDoc.Body.InnerHTML
Case Else
GetInnerX = objDoc.Body.InnerText
End Select
objIE.Quit
Exit Function
ErrorHandler:
If Err.Number 0 Then
strMldg = "Fehler 0x" & Hex(Str(Err.Number)) & " wurde ausgelöst von " \_
& Err.Source & Chr(10) & Err.Description
MsgBox strMldg, vbCritical, "Fehler beim Zugriff auf WWW via InternetExplorer", Err.HelpFile, Err.HelpContext
Err.Clear
End If
End Function
Gruß
Reinhard
Hallo Reinhard,
vielen Dank für den Tipp.
Mir ist grad was ganz Einfaches eingefallen:
Ich öffne die Datei im Text-Editor und setzte mittels ‚Suchen und Ersetzen‘(Ersetze ‚return‘