documentViewer/documentViewer.py - diff

Return to documentViewer.py CVS log

Up to [Repository] / documentViewer

Diff for /documentViewer/documentViewer.py between versions 1.69.2.1 and 1.69.2.8

version 1.69.2.1, 2010/06/14 10:49:48	version 1.69.2.8, 2010/06/16 18:45:16
Line 2	Line 2
from OFS.Folder import Folder	from OFS.Folder import Folder
from Products.PageTemplates.ZopePageTemplate import ZopePageTemplate	from Products.PageTemplates.ZopePageTemplate import ZopePageTemplate
from Products.PageTemplates.PageTemplateFile import PageTemplateFile	from Products.PageTemplates.PageTemplateFile import PageTemplateFile
from Products.PythonScripts.standard import url_quote
from AccessControl import ClassSecurityInfo	from AccessControl import ClassSecurityInfo
from AccessControl import getSecurityManager	from AccessControl import getSecurityManager
from Globals import package_home	from Globals import package_home

from Ft.Xml.Domlette import NonvalidatingReader
from Ft.Xml.Domlette import PrettyPrint, Print
from Ft.Xml import EMPTY_NAMESPACE, Parse	from Ft.Xml import EMPTY_NAMESPACE, Parse

from xml.dom.minidom import parse, parseString

from extraFunction import *


import Ft.Xml.XPath
import cStringIO
import xmlrpclib
import os.path	import os.path
import sys	import sys
import cgi
import urllib	import urllib
	import urllib2
import logging	import logging
import math	import math

import urlparse	import urlparse
from types import *

def logger(txt,method,txt2):	def logger(txt,method,txt2):
"""logging"""	"""logging"""
Line 66 def getParentDir(path):	Line 52 def getParentDir(path):
return '/'.join(path.split('/')[0:-1])	return '/'.join(path.split('/')[0:-1])


	def getHttpData(url, data=None, num_tries=3, timeout=10):
	"""returns result from url+data HTTP request"""
	# we do GET (by appending data to url)
	if isinstance(data, str) or isinstance(data, unicode):
	# if data is string then append
	url = "%s?%s"%(url,data)
	elif isinstance(data, dict) or isinstance(data, list) or isinstance(data, tuple):
	# urlencode
	url = "%s?%s"%(url,urllib.urlencode(data))

	response = None
	errmsg = None
	for cnt in range(num_tries):
	try:
	logging.debug("getHttpData(#%s %ss) url=%s"%(cnt+1,timeout,url))
	if sys.version_info < (2, 6):
	# set timeout on socket -- ugly :-(
import socket	import socket
	socket.setdefaulttimeout(float(timeout))
	response = urllib2.urlopen(url)
	else:
	response = urllib2.urlopen(url,timeout=float(timeout))
	# check result?
	break
	except urllib2.HTTPError, e:
	logging.error("getHttpData: HTTP error(%s): %s"%(e.code,e))
	errmsg = str(e)
	# stop trying
	break
	except urllib2.URLError, e:
	logging.error("getHttpData: URLLIB error(%s): %s"%(e.reason,e))
	errmsg = str(e)
	# stop trying
	#break

	if response is not None:
	data = response.read()
	response.close()
	return data

	raise IOError("ERROR fetching HTTP data from %s: %s"%(url,errmsg))
	#return None

def urlopen(url,timeout=2):
"""urlopen mit timeout"""
socket.setdefaulttimeout(timeout)
ret=urllib.urlopen(url)
socket.setdefaulttimeout(5)
return ret


##	##
## documentViewer class	## documentViewer class
##	##
class documentViewer(Folder, extraFunction):	class documentViewer(Folder):
"""document viewer"""	"""document viewer"""
#textViewerUrl="http://127.0.0.1:8080/HFQP/testXSLT/getPage?"

meta_type="Document viewer"	meta_type="Document viewer"

security=ClassSecurityInfo()	security=ClassSecurityInfo()
Line 123 class documentViewer(Folder, extraFuncti	Line 142 class documentViewer(Folder, extraFuncti
#self['template'] = templateFolder # Zope-2.12 style	#self['template'] = templateFolder # Zope-2.12 style
self._setObject('template',templateFolder) # old style	self._setObject('template',templateFolder) # old style
try:	try:
from Products.XMLRpcTools.XMLRpcTools import XMLRpcServerProxy	import MpdlXmlTextServer
xmlRpcClient = XMLRpcServerProxy(id='fulltextclient', serverUrl=textServerName, use_xmlrpc=False)	textServer = MpdlXmlTextServer(id='fulltextclient')
#templateFolder['fulltextclient'] = xmlRpcClient	#templateFolder['fulltextclient'] = xmlRpcClient
templateFolder._setObject('fulltextclient',xmlRpcClient)	templateFolder._setObject('fulltextclient',textServer)
except Exception, e:	except Exception, e:
logging.error("Unable to create XMLRpcTools for fulltextclient: "+str(e))	logging.error("Unable to create MpdlXmlTextServer for fulltextclient: "+str(e))
try:	try:
from Products.zogiLib.zogiLib import zogiLib	from Products.zogiLib.zogiLib import zogiLib
zogilib = zogiLib(id="zogilib", title="zogilib for docuviewer", dlServerURL=imageScalerUrl, layout="book")	zogilib = zogiLib(id="zogilib", title="zogilib for docuviewer", dlServerURL=imageScalerUrl, layout="book")
Line 138 class documentViewer(Folder, extraFuncti	Line 157 class documentViewer(Folder, extraFuncti
logging.error("Unable to create zogiLib for zogilib: "+str(e))	logging.error("Unable to create zogiLib for zogilib: "+str(e))


	# proxy text server methods to fulltextclient
	def getTextPage(self, **args):
	"""get page"""
	return self.template.fulltextclient.getTextPage(**args)

	def getQuery(self, **args):
	"""get query"""
	return self.template.fulltextclient.getQuery(**args)

	def getSearch(self, **args):
	"""get search"""
	return self.template.fulltextclient.getSearch(**args)

	def getNumPages(self, **args):
	"""get numpages"""
	return self.template.fulltextclient.getNumPages(**args)

	def getTranslate(self, **args):
	"""get translate"""
	return self.template.fulltextclient.getTranslate(**args)

	def getLemma(self, **args):
	"""get lemma"""
	return self.template.fulltextclient.getLemma(**args)

	def getToc(self, **args):
	"""get toc"""
	return self.template.fulltextclient.getToc(**args)

	def getTocPage(self, **args):
	"""get tocpage"""
	return self.template.fulltextclient.getTocPage(**args)


security.declareProtected('View','thumbs_rss')	security.declareProtected('View','thumbs_rss')
def thumbs_rss(self,mode,url,viewMode="auto",start=None,pn=1):	def thumbs_rss(self,mode,url,viewMode="auto",start=None,pn=1):
'''	'''
Line 266 class documentViewer(Folder, extraFuncti	Line 319 class documentViewer(Folder, extraFuncti
params[param] = str(val)	params[param] = str(val)

# quote values and assemble into query string	# quote values and assemble into query string
logging.info("XYXXXXX: %s"%repr(params.items()))	logging.debug("XYXXXXX: %s"%repr(params.items()))
ps = "&".join(["%s=%s"%(k,urllib.quote(v)) for (k, v) in params.items()])	ps = "&".join(["%s=%s"%(k,urllib.quote(v)) for (k, v) in params.items()])
url=self.REQUEST['URL1']+"?"+ps	url=self.REQUEST['URL1']+"?"+ps
return url	return url
Line 285 class documentViewer(Folder, extraFuncti	Line 338 class documentViewer(Folder, extraFuncti
def isAccessible(self, docinfo):	def isAccessible(self, docinfo):
"""returns if access to the resource is granted"""	"""returns if access to the resource is granted"""
access = docinfo.get('accessType', None)	access = docinfo.get('accessType', None)
logger("documentViewer (accessOK)", logging.INFO, "access type %s"%access)	logging.debug("documentViewer (accessOK) access type %s"%access)
if access is not None and access == 'free':	if access is not None and access == 'free':
logger("documentViewer (accessOK)", logging.INFO, "access is free")	logging.debug("documentViewer (accessOK) access is free")
return True	return True
elif access is None or access in self.authgroups:	elif access is None or access in self.authgroups:
# only local access -- only logged in users	# only local access -- only logged in users
Line 298 class documentViewer(Folder, extraFuncti	Line 351 class documentViewer(Folder, extraFuncti
else:	else:
return False	return False

logger("documentViewer (accessOK)", logging.INFO, "unknown access type %s"%access)	logging.debug("documentViewer (accessOK) unknown access type %s"%access)
return False	return False


def getDirinfoFromDigilib(self,path,docinfo=None,cut=0):	def getDirinfoFromDigilib(self,path,docinfo=None,cut=0):
"""gibt param von dlInfo aus"""	"""gibt param von dlInfo aus"""
num_retries = 3
if docinfo is None:	if docinfo is None:
docinfo = {}	docinfo = {}

Line 314 class documentViewer(Folder, extraFuncti	Line 366 class documentViewer(Folder, extraFuncti

infoUrl=self.digilibBaseUrl+"/dirInfo-xml.jsp?mo=dir&fn="+path	infoUrl=self.digilibBaseUrl+"/dirInfo-xml.jsp?mo=dir&fn="+path

logger("documentViewer (getparamfromdigilib)", logging.INFO, "dirInfo from %s"%(infoUrl))	logging.debug("documentViewer (getparamfromdigilib) dirInfo from %s"%(infoUrl))

for cnt in range(num_retries):	txt = getHttpData(infoUrl)
try:	if txt is None:
# dom = NonvalidatingReader.parseUri(imageUrl)
txt=urllib.urlopen(infoUrl).read()
dom = Parse(txt)
break
except:
logger("documentViewer (getdirinfofromdigilib)", logging.ERROR, "error reading %s (try %d)"%(infoUrl,cnt))
else:
raise IOError("Unable to get dir-info from %s"%(infoUrl))	raise IOError("Unable to get dir-info from %s"%(infoUrl))

	dom = Parse(txt)
sizes=dom.xpath("//dir/size")	sizes=dom.xpath("//dir/size")
logger("documentViewer (getparamfromdigilib)", logging.INFO, "dirInfo:size"%sizes)	logging.debug("documentViewer (getparamfromdigilib) dirInfo:size"%sizes)

if sizes:	if sizes:
docinfo['numPages'] = int(getTextFromNode(sizes[0]))	docinfo['numPages'] = int(getTextFromNode(sizes[0]))
Line 342 class documentViewer(Folder, extraFuncti	Line 388 class documentViewer(Folder, extraFuncti

def getIndexMeta(self, url):	def getIndexMeta(self, url):
"""returns dom of index.meta document at url"""	"""returns dom of index.meta document at url"""
num_retries = 3
dom = None	dom = None
metaUrl = None	metaUrl = None
if url.startswith("http://"):	if url.startswith("http://"):
Line 354 class documentViewer(Folder, extraFuncti	Line 399 class documentViewer(Folder, extraFuncti
metaUrl=server+url.replace("/mpiwg/online","")	metaUrl=server+url.replace("/mpiwg/online","")
if not metaUrl.endswith("index.meta"):	if not metaUrl.endswith("index.meta"):
metaUrl += "/index.meta"	metaUrl += "/index.meta"
logging.debug("METAURL: %s"%metaUrl)
for cnt in range(num_retries):
try:
# patch dirk encoding fehler treten dann nicht mehr auf
# dom = NonvalidatingReader.parseUri(metaUrl)
txt=urllib.urlopen(metaUrl).read()
dom = Parse(txt)
break
except:
logger("ERROR documentViewer (getIndexMeta)", logging.INFO,"%s (%s)"%sys.exc_info()[0:2])

if dom is None:	logging.debug("(getIndexMeta): METAURL: %s"%metaUrl)
	txt=getHttpData(metaUrl)
	if txt is None:
raise IOError("Unable to read index meta from %s"%(url))	raise IOError("Unable to read index meta from %s"%(url))

	dom = Parse(txt)
return dom	return dom

def getPresentationInfoXML(self, url):	def getPresentationInfoXML(self, url):
"""returns dom of info.xml document at url"""	"""returns dom of info.xml document at url"""
num_retries = 3
dom = None	dom = None
metaUrl = None	metaUrl = None
if url.startswith("http://"):	if url.startswith("http://"):
Line 383 class documentViewer(Folder, extraFuncti	Line 420 class documentViewer(Folder, extraFuncti
server=self.digilibBaseUrl+"/servlet/Texter?fn="	server=self.digilibBaseUrl+"/servlet/Texter?fn="
metaUrl=server+url.replace("/mpiwg/online","")	metaUrl=server+url.replace("/mpiwg/online","")

for cnt in range(num_retries):	txt=getHttpData(metaUrl)
try:	if txt is None:
# patch dirk encoding fehler treten dann nicht mehr auf
# dom = NonvalidatingReader.parseUri(metaUrl)
txt=urllib.urlopen(metaUrl).read()
dom = Parse(txt)
break
except:
logger("ERROR documentViewer (getPresentationInfoXML)", logging.INFO,"%s (%s)"%sys.exc_info()[0:2])

if dom is None:
raise IOError("Unable to read infoXMLfrom %s"%(url))	raise IOError("Unable to read infoXMLfrom %s"%(url))

	dom = Parse(txt)
return dom	return dom


def getAuthinfoFromIndexMeta(self,path,docinfo=None,dom=None,cut=0):	def getAuthinfoFromIndexMeta(self,path,docinfo=None,dom=None,cut=0):
"""gets authorization info from the index.meta file at path or given by dom"""	"""gets authorization info from the index.meta file at path or given by dom"""
logger("documentViewer (getauthinfofromindexmeta)", logging.INFO,"path: %s"%(path))	logging.debug("documentViewer (getauthinfofromindexmeta) path: %s"%(path))

access = None	access = None

Line 477 class documentViewer(Folder, extraFuncti	Line 506 class documentViewer(Folder, extraFuncti

def getDocinfoFromTextTool(self, url, dom=None, docinfo=None):	def getDocinfoFromTextTool(self, url, dom=None, docinfo=None):
"""parse texttool tag in index meta"""	"""parse texttool tag in index meta"""
logger("documentViewer (getdocinfofromtexttool)", logging.INFO, "url: %s" % (url))	logging.debug("documentViewer (getdocinfofromtexttool) url: %s" % (url))
if docinfo is None:	if docinfo is None:
docinfo = {}	docinfo = {}
if docinfo.get('lang', None) is None:	if docinfo.get('lang', None) is None:
Line 492 class documentViewer(Folder, extraFuncti	Line 521 class documentViewer(Folder, extraFuncti
if archiveNames and (len(archiveNames) > 0):	if archiveNames and (len(archiveNames) > 0):
archiveName = getTextFromNode(archiveNames[0])	archiveName = getTextFromNode(archiveNames[0])
else:	else:
logger("documentViewer (getdocinfofromtexttool)", logging.WARNING, "resource/name missing in: %s" % (url))	logging.warning("documentViewer (getdocinfofromtexttool) resource/name missing in: %s" % (url))

archivePaths = dom.xpath("//resource/archive-path")	archivePaths = dom.xpath("//resource/archive-path")
if archivePaths and (len(archivePaths) > 0):	if archivePaths and (len(archivePaths) > 0):
Line 504 class documentViewer(Folder, extraFuncti	Line 533 class documentViewer(Folder, extraFuncti
archivePath += "/" + archiveName	archivePath += "/" + archiveName
else:	else:
# try to get archive-path from url	# try to get archive-path from url
logger("documentViewer (getdocinfofromtexttool)", logging.WARNING, "resource/archive-path missing in: %s" % (url))	logging.warning("documentViewer (getdocinfofromtexttool) resource/archive-path missing in: %s" % (url))
if (not url.startswith('http')):	if (not url.startswith('http')):
archivePath = url.replace('index.meta', '')	archivePath = url.replace('index.meta', '')

Line 596 class documentViewer(Folder, extraFuncti	Line 625 class documentViewer(Folder, extraFuncti

def getDocinfoFromImagePath(self,path,docinfo=None,cut=0):	def getDocinfoFromImagePath(self,path,docinfo=None,cut=0):
"""path ist the path to the images it assumes that the index.meta file is one level higher."""	"""path ist the path to the images it assumes that the index.meta file is one level higher."""
logger("documentViewer (getdocinfofromimagepath)", logging.INFO,"path: %s"%(path))	logging.debug("documentViewer (getdocinfofromimagepath) path: %s"%(path))
if docinfo is None:	if docinfo is None:
docinfo = {}	docinfo = {}
path=path.replace("/mpiwg/online","")	path=path.replace("/mpiwg/online","")
Line 606 class documentViewer(Folder, extraFuncti	Line 635 class documentViewer(Folder, extraFuncti
pathorig=path	pathorig=path
for x in range(cut):	for x in range(cut):
path=getParentDir(path)	path=getParentDir(path)
logging.error("PATH:"+path)	logging.debug("documentViewer (getdocinfofromimagepath) PATH:"+path)
imageUrl=self.digilibBaseUrl+"/servlet/Scaler?fn="+path	imageUrl=self.digilibBaseUrl+"/servlet/Scaler?fn="+path
docinfo['imageURL'] = imageUrl	docinfo['imageURL'] = imageUrl

Line 618 class documentViewer(Folder, extraFuncti	Line 647 class documentViewer(Folder, extraFuncti

def getDocinfo(self, mode, url):	def getDocinfo(self, mode, url):
"""returns docinfo depending on mode"""	"""returns docinfo depending on mode"""
logger("documentViewer (getdocinfo)", logging.INFO,"mode: %s, url: %s"%(mode,url))	logging.debug("documentViewer (getdocinfo) mode: %s, url: %s"%(mode,url))
# look for cached docinfo in session	# look for cached docinfo in session
if self.REQUEST.SESSION.has_key('docinfo'):	if self.REQUEST.SESSION.has_key('docinfo'):
docinfo = self.REQUEST.SESSION['docinfo']	docinfo = self.REQUEST.SESSION['docinfo']
# check if its still current	# check if its still current
if docinfo is not None and docinfo.get('mode') == mode and docinfo.get('url') == url:	if docinfo is not None and docinfo.get('mode') == mode and docinfo.get('url') == url:
logger("documentViewer (getdocinfo)", logging.INFO,"docinfo in session: %s"%docinfo)	logging.debug("documentViewer (getdocinfo) docinfo in session: %s"%docinfo)
return docinfo	return docinfo
# new docinfo	# new docinfo
docinfo = {'mode': mode, 'url': url}	docinfo = {'mode': mode, 'url': url}
Line 635 class documentViewer(Folder, extraFuncti	Line 664 class documentViewer(Folder, extraFuncti
elif mode=="filepath":	elif mode=="filepath":
docinfo = self.getDocinfoFromImagePath(url, docinfo=docinfo,cut=1)	docinfo = self.getDocinfoFromImagePath(url, docinfo=docinfo,cut=1)
else:	else:
logger("documentViewer (getdocinfo)", logging.ERROR,"unknown mode!")	logging.error("documentViewer (getdocinfo) unknown mode: %s!"%mode)
raise ValueError("Unknown mode %s! Has to be one of 'texttool','imagepath','filepath'."%(mode))	raise ValueError("Unknown mode %s! Has to be one of 'texttool','imagepath','filepath'."%(mode))

logger("documentViewer (getdocinfo)", logging.INFO,"docinfo: %s"%docinfo)	logging.debug("documentViewer (getdocinfo) docinfo: %s"%docinfo)
self.REQUEST.SESSION['docinfo'] = docinfo	self.REQUEST.SESSION['docinfo'] = docinfo
return docinfo	return docinfo

FreeBSD-CVSweb <freebsd-cvsweb@FreeBSD.org>

Removed from v.1.69.2.1
changed lines
	Added in v.1.69.2.8